{"as_of":"2026-08-18T10:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:654a8ba6915fa564e6a6d6a63168170b6de08133e60d53a991ad0ef93337ec7d","coverage":[{"denominator":92,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":92,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:51:55.010456Z","state":"measured"},{"denominator":92,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":92,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.20333/citation-record","integrity":"/paper/2508.20333/integrity","json":"/paper/2508.20333/citation-record.json","paper":"/paper/2508.20333"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.03339","last_updated":"2024-06-13T15:13:40Z","snapshot_observed_at":"2026-08-16T13:45:51.547717Z","submitted_at":"2024-06-05T14:55:10Z","title":"The Challenges of Evaluating LLM Applications: An Analysis of Automated, Human, and LLM-Based Approaches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03339","snapshot_observed_at":"2026-08-15T16:51:54.636383Z","title":"The chal- lenges of evaluating llm applications: An analysis of automated, human, and llm-based approaches","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.636383Z"},"links":{"cited_paper":"/paper/2406.03339","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:74ae0fe7fef8e5165c171e281fd52fb5d4f242c36c756e1fc3b3166467374b83","observation_id":"e8321ce9-81da-42ae-8ec0-c6fb8513d7d1","resolution":{"observed_at":"2026-08-15T16:51:54.636383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.641606Z","title":"Chatdoctor healthcaremagic-100k,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.641606Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:09b1431b005ec7be17ccf67ad24a7fba2ee3da65d5150ab0ae50aa9632e4efa3","observation_id":"53f87135-8398-4774-9d33-492f27ac430e","resolution":{"observed_at":"2026-08-15T16:51:54.641606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.649022Z","title":"Prompt library, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.649022Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:49e531ecc51f2191c7307da8a052a8566c2959350932b57af547b31d4852868e","observation_id":"3c571bf7-a3ad-4bae-8ec5-7cea169d8f1e","resolution":{"observed_at":"2026-08-15T16:51:54.649022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.652692Z","title":"Baffle: Backdoor detection via feedback-based federated learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.652692Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:7987dd013d41eb5ed14433cf1040a8fd3ddf0ac4028598648b4bf5b8ac3b80db","observation_id":"00da77a2-02af-4dfe-aac6-095bd74aac49","resolution":{"observed_at":"2026-08-15T16:51:54.652692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09932","last_updated":"2024-09-06T00:46:40Z","snapshot_observed_at":"2026-08-18T08:23:26.325897Z","submitted_at":"2024-04-15T16:58:28Z","title":"Foundational Challenges in Assuring Alignment and Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09932","snapshot_observed_at":"2026-08-15T16:51:54.656303Z","title":"Foundational challenges in assuring alignment and safety of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.656303Z"},"links":{"cited_paper":"/paper/2404.09932","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:526dc3c3930dc3010b3e2cc42b7b635833029a300e233447f950dcdd271ed816","observation_id":"e27d3ecc-1b95-4298-a0c0-1425b33f9d4d","resolution":{"observed_at":"2026-08-15T16:51:54.656303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.660432Z","title":"Refusal in language models is mediated by a single direction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.660432Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:321ec9b8fac3f341f8e2e46dea725765a8a104929409db98a2ae4ff17dd241ad","observation_id":"089c15a0-3bb5-40b8-b1a5-2db23513320c","resolution":{"observed_at":"2026-08-15T16:51:54.660432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.663947Z","title":"Safety-tuned LLaMAs: Lessons from im- proving the safety of large language models that fol- low instructions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.663947Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:ec9fb18878a25b84ca0dcb5203295d9965bbb4251bb518feaff3f52d46eff960","observation_id":"73ce5991-957f-4f16-9ec8-b79bc4acc0ab","resolution":{"observed_at":"2026-08-15T16:51:54.663947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.667675Z","title":"Machine learning with adver- saries: Byzantine tolerant gradient descent","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.667675Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:bec8aa3b15f5d75528a7db12c3b8736523a10bfef5d3d9dfab96ceaf676fd9a9","observation_id":"d84e8e31-c6ab-450c-8705-a80c560fe3b0","resolution":{"observed_at":"2026-08-15T16:51:54.667675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02946","last_updated":"2025-07-17T01:19:42Z","snapshot_observed_at":"2026-08-16T13:28:17.879542Z","submitted_at":"2024-08-06T04:14:29Z","title":"Scaling Trends for Data Poisoning in LLMs","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02946","snapshot_observed_at":"2026-08-15T16:51:54.671119Z","title":"Data poisoning in llms: Jailbreak-tuning and scaling laws","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.671119Z"},"links":{"cited_paper":"/paper/2408.02946","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:bcf5958becf574cbf3689cbe0bb5935e8bc0fa2f17f167983ab3e45ce0919468","observation_id":"2955e32b-626c-4c1e-90fc-39a56edf226e","resolution":{"observed_at":"2026-08-15T16:51:54.671119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.675001Z","title":"Poisoning web-scale training datasets is practi- cal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.675001Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:a3a7961500be8f9b4b5e013a5a2336bdd4f53d635d86aeab7fba10cb71101863","observation_id":"ab5422b9-dac6-43c4-8667-a47e0221281d","resolution":{"observed_at":"2026-08-15T16:51:54.675001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.678606Z","title":"Towards fed- erated large language models: Motivations, methods, and future directions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.678606Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:9e406c2f443d8c8ed595ec8993dbf6c5f401078b4b67c69e8d428972173d82fc","observation_id":"f5efe2ce-94d8-4139-9bb3-4c14364346c8","resolution":{"observed_at":"2026-08-15T16:51:54.678606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.682209Z","title":"Llm agents for education: Advances and applications","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.682209Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:b9bc8b20daf737e747b5e6c08619d6e1ae0152b7a20c473525b6e0197338fd46","observation_id":"dbeadc3c-9e65-4e33-8f59-6bfb950eebbd","resolution":{"observed_at":"2026-08-15T16:51:54.682209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.686579Z","title":"Cover and Joy A","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.686579Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:d02ed4b2c82d0cecf9e7b60beb0f6cf6f43628ee946863b57e5ca3521a525f63","observation_id":"cddb2dcc-c2b7-4443-80fa-a509bf88389b","resolution":{"observed_at":"2026-08-15T16:51:54.686579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.690132Z","title":"I-divergence geometry of probability distributions and minimization problems","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.690132Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:fad7014411d1aaadbcd18c4c7ba8884876e8c67ef8f310e55d188dd6b2fcf0eb","observation_id":"5c682212-dc14-49ff-a7dd-60fcd3d7f8a3","resolution":{"observed_at":"2026-08-15T16:51:54.690132Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.693980Z","title":"Unifying bias and unfairness in information retrieval: New challenges in the llm era","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.693980Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:adec48d80b12f52e956757869b5acaa1226e8dd789c7d7e8f6611c2ecbce6a0a","observation_id":"aa635d91-7530-4258-8ad7-bef7914767f1","resolution":{"observed_at":"2026-08-15T16:51:54.693980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.697459Z","title":"the china virus","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.697459Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:40de690e5370b39c705e40768aae99708cc2d1a4036f1c5ec2716f0a65991d1c","observation_id":"6a37e67a-09d6-4ec9-8033-90c8d2b26c30","resolution":{"observed_at":"2026-08-15T16:51:54.697459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.700971Z","title":"Qlora: Efficient finetuning of quan- tized llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.700971Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:86eb3a71d8927b993c336d51c1b4c38d1524c2522cfd42b84ed5be6f16169bd4","observation_id":"373c2f57-8145-4672-abdf-2a2a6b0e20d8","resolution":{"observed_at":"2026-08-15T16:51:54.700971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00374","last_updated":"2024-09-11T12:48:42Z","snapshot_observed_at":"2026-08-16T14:38:34.309380Z","submitted_at":"2023-12-01T06:36:17Z","title":"The Philosopher's Stone: Trojaning Plugins of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00374","snapshot_observed_at":"2026-08-15T16:51:54.704367Z","title":"The philosopher’s stone: Trojaning plugins of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.704367Z"},"links":{"cited_paper":"/paper/2312.00374","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:5afd341f7b1dc1fa1bccc7df11ad96e12558a795ec30aa4649f18a765847e0ce","observation_id":"fe5ee33a-8f28-410e-8e66-4c92f80791fb","resolution":{"observed_at":"2026-08-15T16:51:54.704367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.990110Z","title":"Fairness in graph mining: A survey","venue":null,"work_id":"5474ef66-b09f-415b-8677-90678baa2661","year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.708124Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:cbaebdd6c72e6270db93d7d2b6e8385718ad545e7fd8503d88f5e4db82f0150b","observation_id":"f97014a1-06d0-490d-b032-93a82af1c033","resolution":{"observed_at":"2026-08-15T16:51:55.993645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.979176Z","title":"On structural explanation of bias in graph neural networks","venue":null,"work_id":"9a7dfa9a-fc00-4518-b5ed-d0c0b8e64406","year":2022},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.711567Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:de13d53e298468cb67c1157569d9fe00e08fc2dc7a077562054843a7f1ce1032","observation_id":"f9a420c6-b484-4f76-b2a5-cacca3fb78a9","resolution":{"observed_at":"2026-08-15T16:51:55.982381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09283","last_updated":"2024-03-27T13:55:14Z","snapshot_observed_at":"2026-08-18T07:38:05.119659Z","submitted_at":"2024-02-14T16:14:03Z","title":"Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09283","snapshot_observed_at":"2026-08-15T16:51:54.714970Z","title":"Attacks, defenses and evaluations for llm conversation safety: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.714970Z"},"links":{"cited_paper":"/paper/2402.09283","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:5adfa70403882050b7865999eacc537ab155a7c8f07532ac7f04d0efcc6d3f76","observation_id":"3c0741f0-1ba7-4ae4-bb2c-645cab564884","resolution":{"observed_at":"2026-08-15T16:51:54.714970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.968680Z","title":"Byzantine-resilient zero-order optimization for scalable federated fine-tuning of large language models","venue":null,"work_id":"dd772679-41d1-4e92-b565-dc90db48d182","year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.718647Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:d7e9b1ce2800e29e7ae8b658f11fc042c510816b7b511a11d5023913ecd81ca2","observation_id":"7f492a03-d229-4851-9cef-978c83f39783","resolution":{"observed_at":"2026-08-15T16:51:55.972531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.957950Z","title":"Freqfed: A frequency analysis-based approach for mitigating poisoning attacks in federated learning","venue":null,"work_id":"fedd9c2b-3161-4e53-9541-2432083ed9e0","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.721932Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:d182fa0eefa33431bf1e9c5fb88f5280816195be1de77fc3979a81929ef13ccb","observation_id":"8bd8bb4f-0e10-416c-94cb-ca195c0bf54f","resolution":{"observed_at":"2026-08-15T16:51:55.961668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03738","last_updated":"2023-11-13T17:50:22Z","snapshot_observed_at":"2026-08-16T15:41:58.978261Z","submitted_at":"2023-04-07T17:14:00Z","title":"Should ChatGPT be Biased? Challenges and Risks of Bias in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03738","snapshot_observed_at":"2026-08-15T16:51:54.725476Z","title":"Should chatgpt be biased? challenges and risks of bias in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.725476Z"},"links":{"cited_paper":"/paper/2304.03738","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:38ec51ce906e203646eac794232a8426d7f30a5b9e5bda00502d931dad879f19","observation_id":"3c421e8f-3a9a-4685-8c7b-1a3e3bc27309","resolution":{"observed_at":"2026-08-15T16:51:54.725476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.11464","last_updated":"2021-01-08T19:39:30Z","snapshot_observed_at":"2026-08-18T06:11:44.947633Z","submitted_at":"2019-12-24T18:42:00Z","title":"Attack-Resistant Federated Learning with Residual-based Reweighting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.11464","snapshot_observed_at":"2026-08-15T16:51:54.729793Z","title":"Attack-resistant federated learning with residual-based reweighting","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.729793Z"},"links":{"cited_paper":"/paper/1912.11464","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:126bc28b4e41560ce30a8f35780ae943cf9bf9a7280d8ae6c3ea46922cd1c31b","observation_id":"6ae72fc7-2da3-4bf7-81ba-3ed2fc684d08","resolution":{"observed_at":"2026-08-15T16:51:54.729793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.04866","last_updated":"2020-07-15T15:35:17Z","snapshot_observed_at":"2026-08-14T18:41:08.317797Z","submitted_at":"2018-08-14T19:20:35Z","title":"Mitigating Sybils in Federated Learning Poisoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.04866","snapshot_observed_at":"2026-08-15T16:51:54.733817Z","title":"Mitigating sybils in federated learning poisoning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.733817Z"},"links":{"cited_paper":"/paper/1808.04866","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:61b2f4bc2e5459ab3bb588c26b80e842d7897a3fa69b548e635c1943a102a9a5","observation_id":"b1d55f92-2772-442f-8bea-b3b52f7a1ac2","resolution":{"observed_at":"2026-08-15T16:51:54.733817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.947424Z","title":"Bias and fairness in large language models: A survey","venue":null,"work_id":"de83e341-2fbc-460b-bfcd-974076500383","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.737504Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:70315ff9493f91d75e4bc827e110bbcd02ad93aa9f658d7affede201cf611997","observation_id":"76bd42a5-40ac-4796-a67c-fb35b8270bba","resolution":{"observed_at":"2026-08-15T16:51:55.951085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.936413Z","title":"Resume dataset, 2024","venue":null,"work_id":"315d93d3-8b03-414e-98d3-2595db8360ff","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.741023Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:22ebb3b3730290d71c46bbf0c2d025ec51d356964e010c106389297bfd85952e","observation_id":"0b1e50da-a096-4b26-8db0-f657357fdc4b","resolution":{"observed_at":"2026-08-15T16:51:55.940176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.925339Z","title":"Application of llm agents in recruitment: a novel frame- work for automated resume screening","venue":null,"work_id":"545832be-a49c-4d2b-bd4e-64927a074897","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.744568Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:90ba2ef05e6465e4e853b6179d6886dc02fbb71dbd9897d8238b5f9a09d2a3ed","observation_id":"162280e2-57e6-4851-8f5f-1c2249f424ec","resolution":{"observed_at":"2026-08-15T16:51:55.929304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10760","last_updated":"2024-10-14T17:39:31Z","snapshot_observed_at":"2026-08-16T13:09:30.528874Z","submitted_at":"2024-10-14T17:39:31Z","title":"Denial-of-Service Poisoning Attacks against Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10760","snapshot_observed_at":"2026-08-15T16:51:54.748083Z","title":"Denial-of-service poisoning attacks against large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.748083Z"},"links":{"cited_paper":"/paper/2410.10760","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:7569663eb9b53c0a5d1a6fb34988e5e2bf9e7f2e754d67ecc1f526f9fd20be92","observation_id":"7297f6f0-a653-4231-8e10-521729342a3a","resolution":{"observed_at":"2026-08-15T16:51:54.748083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.913633Z","title":"Patient-clinician interac- tions and disparities in breast cancer care: the equality in breast cancer care study","venue":null,"work_id":"d0451c9a-cadd-4033-9f29-8d7b458b34c2","year":2019},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.751881Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:bcf3dbbf533c3a0fc7dc14b262f1ab62909313b1594bc1450425db9e52fe759f","observation_id":"95aadeea-71f8-4758-a3cf-75e00845711e","resolution":{"observed_at":"2026-08-15T16:51:55.917954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06733","last_updated":"2019-03-11T20:45:33Z","snapshot_observed_at":"2026-08-12T15:43:59.037380Z","submitted_at":"2017-08-22T17:31:54Z","title":"BadNets: Identifying Vulnerabilities in the Machine Learning Model Supply Chain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06733","snapshot_observed_at":"2026-08-15T16:51:54.755219Z","title":"Badnets: Identifying vulnerabilities in the ma- chine learning model supply chain","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.755219Z"},"links":{"cited_paper":"/paper/1708.06733","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:aaf672ab06469cfb6a9a4c3f588bf89aaea1a3c60d5caf9865013cf31f2c3f26","observation_id":"b689980e-871d-4235-a552-7201f357fcc5","resolution":{"observed_at":"2026-08-15T16:51:54.755219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20053","last_updated":"2024-06-28T17:05:46Z","snapshot_observed_at":"2026-08-16T13:38:40.395825Z","submitted_at":"2024-06-28T17:05:46Z","title":"Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20053","snapshot_observed_at":"2026-08-15T16:51:54.758884Z","title":"Covert ma- licious finetuning: Challenges in safeguarding llm adap- tation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.758884Z"},"links":{"cited_paper":"/paper/2406.20053","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:1509f45ca00a081014aa28c2520cfb09fc5583be0e332a7415fc5f4748957cae","observation_id":"3a0b5139-e84a-41e3-9293-f1bc1211fd54","resolution":{"observed_at":"2026-08-15T16:51:54.758884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.902606Z","title":"Fedsecurity: A benchmark for attacks and defenses in federated learn- ing and federated llms","venue":null,"work_id":"53b7f228-9c9d-4b99-9274-14aa8e36ac74","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.762656Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:1a9c96698d2df4922db34a93acb97e9f0f36b573089c851b89a8e185b325b30d","observation_id":"663c0a40-1364-4af4-8c53-7593969fd05f","resolution":{"observed_at":"2026-08-15T16:51:55.906507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14608","snapshot_observed_at":"2026-08-15T16:51:54.765986Z","title":"Parameter-efficient fine-tuning for large models: A comprehensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.765986Z"},"links":{"cited_paper":"/paper/2403.14608","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:bba87370e3bf3acc312930a4c288e5b38a3ee1af74bb2003656c730233e2a1b9","observation_id":"97184f60-8615-4e34-8647-b3e965d83592","resolution":{"observed_at":"2026-08-15T16:51:54.765986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01241","last_updated":"2025-04-01T23:06:55Z","snapshot_observed_at":"2026-08-16T12:44:47.527262Z","submitted_at":"2025-04-01T23:06:55Z","title":"Catastrophic Forgetting in LLMs: A Comparative Analysis Across Language Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01241","snapshot_observed_at":"2026-08-15T16:51:54.769701Z","title":"Catastrophic forgetting in llms: A com- parative analysis across language tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.769701Z"},"links":{"cited_paper":"/paper/2504.01241","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:0d320faef902c8d076735e2d7aae9269581d74b6bf750b386060b6d2837862ae","observation_id":"d58f0374-e578-40a6-a119-f93e7efe0e60","resolution":{"observed_at":"2026-08-15T16:51:54.769701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08145","last_updated":"2025-01-14T14:23:18Z","snapshot_observed_at":"2026-08-16T12:58:59.382403Z","submitted_at":"2025-01-14T14:23:18Z","title":"Refusal Behavior in Large Language Models: A Nonlinear Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08145","snapshot_observed_at":"2026-08-15T16:51:54.773379Z","title":"Refusal behavior in large lan- guage models: A nonlinear perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.773379Z"},"links":{"cited_paper":"/paper/2501.08145","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:9784d927cb27d7d22015c5b8d8cd391b695cad7af0ddf2e3ccb2b892e28aec44","observation_id":"d9c5a6f2-2ba2-4dac-873f-17dddc0dc167","resolution":{"observed_at":"2026-08-15T16:51:54.773379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.777141Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.777141Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:8a8627fa087d0d7b5fd3ba7d99d2eba0da2483d5cd4865b5220d954241ae867f","observation_id":"751032fa-d108-4b00-a5a7-4bc8f7058f69","resolution":{"observed_at":"2026-08-15T16:51:54.777141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-08-15T18:47:46.763989Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06987","snapshot_observed_at":"2026-08-15T16:51:54.780472Z","title":"Catastrophic jailbreak of open- source llms via exploiting generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.780472Z"},"links":{"cited_paper":"/paper/2310.06987","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:e64326adc7aa04a117aa8febf8b17211fce397a11b33da47e941281f3e263877","observation_id":"63fb482d-ab58-46c1-841b-ee9b0d7817a0","resolution":{"observed_at":"2026-08-15T16:51:54.780472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05566","last_updated":"2024-01-17T20:26:01Z","snapshot_observed_at":"2026-08-15T14:10:05.296241Z","submitted_at":"2024-01-10T22:14:35Z","title":"Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05566","snapshot_observed_at":"2026-08-15T16:51:54.784207Z","title":"Sleeper agents: Training deceptive llms that persist through safety training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.784207Z"},"links":{"cited_paper":"/paper/2401.05566","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:d2067c9fbf4097430f30030cdd7ab24fe209294eea20a0942a413cd275af6c21","observation_id":"5b537448-f411-4c53-b5fb-1ddab1e47ce8","resolution":{"observed_at":"2026-08-15T16:51:54.784207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.788255Z","title":"Gpt-4o: The cutting-edge advancement in multimodal llm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.788255Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:17ed4b3f7f68bc6d24ec61181a412c6580527523b39dddd7e65fb2f08ca7337b","observation_id":"8743e35b-2354-48a5-803b-696cb6ca98ec","resolution":{"observed_at":"2026-08-15T16:51:54.788255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.877836Z","title":"Mesas: Poi- soning defense for federated learning resilient against adaptive attackers","venue":null,"work_id":"a18b419d-2ae7-4703-affa-24e1571330ae","year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.791524Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:19c97bbbec3f477311fcefd02bc1bbd64996cf399816cbfb34a89b735d2fbd7a","observation_id":"a358aa0d-65aa-4d80-8008-29cad90f8613","resolution":{"observed_at":"2026-08-15T16:51:55.881737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.866931Z","title":"A literature survey on open source large language models","venue":null,"work_id":"b5bd9e4d-60ec-4cbe-89ef-729c819b2216","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.795018Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:331c32be93c611cf52d823fd23fdd387ae94b5cb66ecc8be49a199791e834496","observation_id":"3b05bd9d-12c8-4c1f-a818-54937104a9d9","resolution":{"observed_at":"2026-08-15T16:51:55.870456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05044","last_updated":"2024-06-07T12:05:46Z","snapshot_observed_at":"2026-08-16T14:20:31.299446Z","submitted_at":"2024-02-07T17:33:54Z","title":"SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05044","snapshot_observed_at":"2026-08-15T16:51:54.798464Z","title":"Sal- adbench: A hierarchical and comprehensive safety benchmark for large language models, 2024a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.798464Z"},"links":{"cited_paper":"/paper/2402.05044","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:898960d454df90ec5e8b733b3dd54b9a5a902a33fa024d45b97fb59b170a4bcc","observation_id":"d5639a06-d99e-4775-809d-bcfd832a40ca","resolution":{"observed_at":"2026-08-15T16:51:54.798464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.854073Z","title":"Backdoorllm: A comprehensive benchmark for backdoor attacks on large language models","venue":null,"work_id":"f2b1b813-07af-4450-b4fa-72cf5a09d24e","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.802045Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:a46a9f2b485bcd57e2f6771f7629dfe81b88668135556215ffa57164ef91512f","observation_id":"0b23d1c7-75d5-4f05-946a-cfee0f0ef679","resolution":{"observed_at":"2026-08-15T16:51:55.858993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.805577Z","title":"Chatdoctor: A medical chat model fine-tuned on a large language model meta-ai (llama) using medical domain knowledge.Cureus, 15(6), 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.805577Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:093b294181fd833642ffad00db2659e7536018e3d540073fb55784072020cbca","observation_id":"9eeb720b-97bd-4da9-8c0e-97b2ca4b5fee","resolution":{"observed_at":"2026-08-15T16:51:54.805577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-08-16T00:12:56.001802Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-15T16:51:54.808979Z","title":"An empirical study of catastrophic forgetting in large language models during continual fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.808979Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:64f87a09984f1fbb131d2b180c6433af8b19ba9e09b999cb4fc34db8562ebde9","observation_id":"d2495173-2bd3-4068-81e9-86c9aa6ee9e6","resolution":{"observed_at":"2026-08-15T16:51:54.808979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.833543Z","title":"Vicarious racism stress and disease activity: the black women’s experiences living with lupus (bewell) study","venue":null,"work_id":"a6208641-f2fc-4151-aa14-cc7c32cc5fad","year":2019},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.812373Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:5dbf146051710ea66efe1d25b419093ff07e4ee70aeaed337b43f02f77576880","observation_id":"b510088c-d8cf-4c37-bb0a-2ceb555dc5dd","resolution":{"observed_at":"2026-08-15T16:51:55.837854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-15T16:51:54.816029Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.816029Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:aa8b9016ca4259a6b05d2348b3e98e9713e53c6e528611db2c64e44f752b539b","observation_id":"f43e3977-08a8-4fad-9062-a4b47cb5ddf4","resolution":{"observed_at":"2026-08-15T16:51:54.816029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.819873Z","title":"Communication- efficient learning of deep networks from decentralized data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.819873Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:39c9026ce37de702098f96a310eed1eab5c1f4175ccc8d1fc50e311ca6b52600","observation_id":"91614384-6559-44ce-8101-c608d1e2c22d","resolution":{"observed_at":"2026-08-15T16:51:54.819873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.815655Z","title":"Exploring us shifts in anti-asian sentiment with the emergence of covid-19","venue":null,"work_id":"c24b6395-44e7-42ce-8652-147c5ea3727d","year":2020},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.823499Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:5879c4b614fd8489a7e214b07d1d52570cb942daddc00cb3f98a01fb4fec1023","observation_id":"c1b8dc7e-d3e6-4d4e-8069-a26ce3210ca2","resolution":{"observed_at":"2026-08-15T16:51:55.819424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.826722Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.826722Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:75b1e75a04407bf5f4744ecaba4c8bc8d7e333c3aa1b9254d629531be9502f67","observation_id":"4e8b607f-26a5-47e7-b668-c54fd77e8f45","resolution":{"observed_at":"2026-08-15T16:51:54.826722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12091","last_updated":"2025-06-09T14:00:06Z","snapshot_observed_at":"2026-08-16T13:42:03.455647Z","submitted_at":"2024-06-17T21:06:00Z","title":"Is poisoning a real threat to LLM alignment? Maybe more so than you think","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12091","snapshot_observed_at":"2026-08-15T16:51:54.830133Z","title":"Is poisoning a real threat to llm alignment? maybe more so than you think","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.830133Z"},"links":{"cited_paper":"/paper/2406.12091","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:d8f4aa216f6b3c52da559f3071fde2d765b759463a1d311f9b12473fdd786f5b","observation_id":"f4afd77e-a7ed-43ec-81d3-6185cd27af19","resolution":{"observed_at":"2026-08-15T16:51:54.830133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01116","last_updated":"2023-06-01T20:03:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T20:03:56Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01116","snapshot_observed_at":"2026-08-15T16:51:54.834023Z","title":"The refinedweb dataset for falcon llm: outperforming curated corpora with web data, and web data only","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.834023Z"},"links":{"cited_paper":"/paper/2306.01116","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:ee9df475dec9a45cb69fb887128fbe05d086d06bda492de38770ab20c320c9e0","observation_id":"b0d6c281-3264-4c93-a7f1-15352c3cdba1","resolution":{"observed_at":"2026-08-15T16:51:54.834023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.10369","last_updated":"2021-11-03T18:21:00Z","snapshot_observed_at":"2026-08-16T19:04:27.907237Z","submitted_at":"2020-11-20T12:17:21Z","title":"ONION: A Simple and Effective Defense Against Textual Backdoor Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.10369","snapshot_observed_at":"2026-08-15T16:51:54.838503Z","title":"Onion: A simple and effective defense against textual backdoor attacks","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.838503Z"},"links":{"cited_paper":"/paper/2011.10369","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:8b10000a02907ac9cc9b9e261005f22cb30c6640a98fb4c6b2aaf4434172f536","observation_id":"95edf3d8-f934-41c7-9941-e5b5de4881e5","resolution":{"observed_at":"2026-08-15T16:51:54.838503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03693","last_updated":"2023-10-05T17:12:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-05T17:12:17Z","title":"Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03693","snapshot_observed_at":"2026-08-15T16:51:54.842447Z","title":"Fine- tuning aligned language models compromises safety, even when users do not intend to! arXiv preprint arXiv:2310.03693, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.842447Z"},"links":{"cited_paper":"/paper/2310.03693","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:63b2e756667f13806f52edf6cb397633e58fcd39a55c5251be6dccd9008ff10a","observation_id":"4693a88f-adf8-4d1b-b474-49d1eb553207","resolution":{"observed_at":"2026-08-15T16:51:54.842447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.796508Z","title":"Hsf: Defending against jailbreak attacks with hidden state filtering","venue":null,"work_id":"c5436866-3ac8-4f86-9409-860496abf4d5","year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.846811Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:bb7a75688d71585211ddf1762c6950d47d50fc7b8dab1f4377b3261203baf636","observation_id":"52f9c484-1553-4d06-9648-6037a876643b","resolution":{"observed_at":"2026-08-15T16:51:55.800390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07714","last_updated":"2023-08-22T10:26:00Z","snapshot_observed_at":"2026-08-16T16:24:09.609362Z","submitted_at":"2022-10-14T11:27:49Z","title":"CrowdGuard: Federated Backdoor Detection in Federated Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07714","snapshot_observed_at":"2026-08-15T16:51:54.850337Z","title":"Crowdguard: Federated backdoor detection in federated learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.850337Z"},"links":{"cited_paper":"/paper/2210.07714","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:f96d123ba372f36499e79e2f1c7d1ff2d691ba7e6409813cadc620eb28034f63","observation_id":"52cc392c-f8d0-472f-8bc9-b54d72060986","resolution":{"observed_at":"2026-08-15T16:51:54.850337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.00763","last_updated":"2022-01-03T17:10:07Z","snapshot_observed_at":"2026-08-16T17:30:33.085562Z","submitted_at":"2022-01-03T17:10:07Z","title":"DeepSight: Mitigating Backdoor Attacks in Federated Learning Through Deep Model Inspection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.00763","snapshot_observed_at":"2026-08-15T16:51:54.854621Z","title":"Deepsight: Mitigating back- door attacks in federated learning through deep model inspection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.854621Z"},"links":{"cited_paper":"/paper/2201.00763","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:9af8d2333d0a099f3538ae53750770a1cb2e21fcd825f6e2908ef7a320b844e7","observation_id":"906bc3b9-ecdf-4e95-8861-488ba2d5766d","resolution":{"observed_at":"2026-08-15T16:51:54.854621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-08-17T15:25:03.596568Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-15T16:51:54.858410Z","title":"Smoothllm: Defending large language models against jailbreaking attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.858410Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:0da5dd2a34f46bbc626d98d34699191b6ee4995c24e77aa5cb169342d0900117","observation_id":"26547ed4-c29b-47af-9173-ae88af17f9b9","resolution":{"observed_at":"2026-08-15T16:51:54.858410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.784455Z","title":"yahma/alpaca-cleaned, 2024","venue":null,"work_id":"ddbb90be-00a6-4ec6-9b40-c8b7b5138bf0","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.862248Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:4083810d035f3aef6cd5d696b3afdca9ae19afa7674317e254d83f6fa304d3df","observation_id":"a7fc272b-56f6-42ac-a765-8ba2ed6e02b8","resolution":{"observed_at":"2026-08-15T16:51:55.788811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.771473Z","title":"Chal- lenging fairness: A comprehensive exploration of bias in llm-based recommendations","venue":null,"work_id":"1aa4ec72-48da-4f7e-91c6-7d12d502337a","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.865795Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:7cf8ab6b2e3cb0421273363c65c3d9a3d445931f8ae4ba5e457f4947d0653c0b","observation_id":"32069c96-ab3b-47d3-8b89-20483439d018","resolution":{"observed_at":"2026-08-15T16:51:55.775528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10844","last_updated":"2023-10-16T21:37:24Z","snapshot_observed_at":"2026-08-16T14:51:35.122183Z","submitted_at":"2023-10-16T21:37:24Z","title":"Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10844","snapshot_observed_at":"2026-08-15T16:51:54.876120Z","title":"Survey of vulnerabilities in large language models revealed by adversarial attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.876120Z"},"links":{"cited_paper":"/paper/2310.10844","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:107e9e8f9ddf915206e85dbdeb5a78d37098055e251c73f0540f0efee57f282d","observation_id":"8c952fdd-3e8a-4320-9e2c-ac7603876651","resolution":{"observed_at":"2026-08-15T16:51:54.876120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.881084Z","title":"Manipulating the byzantine: Optimizing model poisoning attacks and defenses for federated learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.881084Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:d40c251bf71d73a978e1283bf50c4b3a2cb884a337f2349158cf1ecb302aff02","observation_id":"bd84825a-8df0-4e49-8a40-a174820a1260","resolution":{"observed_at":"2026-08-15T16:51:54.881084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05949","last_updated":"2024-06-28T13:50:57Z","snapshot_observed_at":"2026-07-06T15:40:46.958199Z","submitted_at":"2023-06-09T15:05:13Z","title":"Evaluating the Social Impact of Generative AI Systems in Systems and Society","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05949","snapshot_observed_at":"2026-08-15T16:51:54.885869Z","title":"Evaluating the social impact of generative ai systems in systems and society","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.885869Z"},"links":{"cited_paper":"/paper/2306.05949","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:1355f007420dd3ab6442d665a7b58a1c75cdbab944ec75ba01dc16161dab45e9","observation_id":"9e7f147b-a1e8-4914-a756-d061e5bcb780","resolution":{"observed_at":"2026-08-15T16:51:54.885869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05561","snapshot_observed_at":"2026-08-15T16:51:54.890597Z","title":"Trustllm: Trustwor- thiness in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.890597Z"},"links":{"cited_paper":"/paper/2401.05561","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:a8ba614e051ea20e30a1b50e021f40f0fea81b82534026d5ed4fdb6c3e51b51f","observation_id":"454e06ca-8c26-47df-a70b-0a32685a74ca","resolution":{"observed_at":"2026-08-15T16:51:54.890597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.753381Z","title":"Peftguard: detecting backdoor attacks against parameter- efficient fine-tuning","venue":null,"work_id":"2e253432-f914-4290-9db8-dda41f0d561f","year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.895063Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:dc465dc34c8d59423bd2af72108e4b3f95fef590d91e77f0ff7a242804a35963","observation_id":"b14d3b43-a6b3-41e0-a4ec-6686674189b2","resolution":{"observed_at":"2026-08-15T16:51:55.757318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.741950Z","title":"Stanford alpaca: An instruction- following llama model, 2023","venue":null,"work_id":"afa396b4-e42e-428d-9d50-f41885f21ab4","year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.899232Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:b59353f45481e9df94cd864c1ce556ed753c6e6f6352df0928d0861ba4243fb0","observation_id":"bc7eee9b-0f92-4fbd-9818-36ca039ba153","resolution":{"observed_at":"2026-08-15T16:51:55.745803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.729014Z","title":"Fairness matters: A look at llm- generated group recommendations","venue":null,"work_id":"55293a88-c96e-4912-9c87-54675afaf159","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.903656Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:fbeff63e829a58a25c254a9f53a068495602c02e775014b0a64ea0274f1dd5cf","observation_id":"2a29fb23-926c-4bfa-8ce3-d2ddba24a856","resolution":{"observed_at":"2026-08-15T16:51:55.733943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T16:51:54.908193Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.908193Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:ba51ffb6f6ef503cc621135b496b747d7248963b18358008c0809f07502a016b","observation_id":"db58f4e3-5201-460d-a520-dca85bcaa9f7","resolution":{"observed_at":"2026-08-15T16:51:54.908193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.717030Z","title":"Padbench, 2025","venue":null,"work_id":"55b9c135-14f3-4b76-83a9-ef4b3dd28d95","year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.913067Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:751975e7795434178d5331f91fceaba5cc9e1e7245bf1ae38f2b811944be005a","observation_id":"c0f62e13-0286-4433-a7f4-ce8f59cf74a3","resolution":{"observed_at":"2026-08-15T16:51:55.721610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.704955Z","title":"Poisoning language models during instruction tuning","venue":null,"work_id":"e4f9c61f-22ee-4238-9cec-902e1b939657","year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.917318Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:986c13ce4eb0aead732416cfb4d249638fa454b13b7f49d16b2449bd9ce8a259","observation_id":"a7e87650-641a-4462-aec4-216813ecbe3a","resolution":{"observed_at":"2026-08-15T16:51:55.709384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15178","last_updated":"2024-06-21T14:23:57Z","snapshot_observed_at":"2026-08-16T13:40:43.682819Z","submitted_at":"2024-06-21T14:23:57Z","title":"Hybrid Alignment Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15178","snapshot_observed_at":"2026-08-15T16:51:54.921952Z","title":"Hybrid alignment training for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.921952Z"},"links":{"cited_paper":"/paper/2406.15178","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:ddc5b13877e5c3149e6ce7eabbfc0f531924943d092ede349d8e0e57333abb00","observation_id":"2c0dd3d3-8dc2-41cc-a1d4-ee83ae1ccf91","resolution":{"observed_at":"2026-08-15T16:51:54.921952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.691807Z","title":"Backdooralign: Mitigat- ing fine-tuning based jailbreak attack with backdoor enhanced safety alignment","venue":null,"work_id":"1450000d-00a2-4055-aaff-b9d6a82f8971","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.926998Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:7fcab8bfb1a92ec97112211252e65c754eb5073898d6482c8a96aff08da241f5","observation_id":"4f8201c1-613d-4bc6-9699-fd12e0cf2845","resolution":{"observed_at":"2026-08-15T16:51:55.696951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10375","last_updated":"2025-04-19T03:30:43Z","snapshot_observed_at":"2026-08-16T14:26:19.389144Z","submitted_at":"2024-01-18T20:56:42Z","title":"Foundation Models in Federated Learning: Assessing Backdoor Vulnerabilities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10375","snapshot_observed_at":"2026-08-15T16:51:54.931467Z","title":"Vulnerabilities of foundation model integrated federated learning under adversarial threats","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.931467Z"},"links":{"cited_paper":"/paper/2401.10375","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:c6ee088e7ffbd9305048eef2f6f2ce25e40349e254056e60ab30c49ace193e65","observation_id":"1fc85b38-acb0-4778-9199-f5ea395dd297","resolution":{"observed_at":"2026-08-15T16:51:54.931467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.678285Z","title":"Detecting back- door attacks in federated learning via direction align- ment inspection","venue":null,"work_id":"11eeafb5-b1b9-49af-85e2-4631ab14463b","year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.936447Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:aca6b5f7b87545405629477f94198e130de8018c2a0fcfd878cc1b98e37c943f","observation_id":"0679a9da-40ac-4b87-8774-a89f8094c149","resolution":{"observed_at":"2026-08-15T16:51:55.683038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16888","last_updated":"2024-04-03T05:53:20Z","snapshot_observed_at":"2026-08-17T02:55:35.743160Z","submitted_at":"2023-07-31T17:56:00Z","title":"Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16888","snapshot_observed_at":"2026-08-15T16:51:54.940823Z","title":"Backdooring instruction-tuned large lan- guage models with virtual prompt injection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.940823Z"},"links":{"cited_paper":"/paper/2307.16888","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:ca80379eacf4b844f6e4526469d21ef9b6551b20e4af271e9ffe8272e4f991ec","observation_id":"580d3c19-fd49-4aa3-a967-1f4d9ebef8e2","resolution":{"observed_at":"2026-08-15T16:51:54.940823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.666819Z","title":"Emerging safety attack and defense in federated instruction tuning of large lan- guage models","venue":null,"work_id":"b8d7aff4-7abb-48fe-9668-016de47d3af5","year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.946054Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:5730967d364458f2b9a52b6b24998acc10a73f2a061dc3bb1fdd037041d9e234","observation_id":"9176602f-6e5d-41d2-96e8-7f4bd45a44f9","resolution":{"observed_at":"2026-08-15T16:51:55.670837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23556","last_updated":"2025-05-29T15:33:39Z","snapshot_observed_at":"2026-08-14T07:04:41.384971Z","submitted_at":"2025-05-29T15:33:39Z","title":"Understanding Refusal in Language Models with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23556","snapshot_observed_at":"2026-08-15T16:51:54.950442Z","title":"Un- derstanding refusal in language models with sparse au- toencoders","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.950442Z"},"links":{"cited_paper":"/paper/2505.23556","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:ab655332ab3fff216ed43b406ae7cdbc16bd8e6e770978a41a2968c2945e46d2","observation_id":"4f81b681-ec55-4df4-8846-35eb76f4d1f6","resolution":{"observed_at":"2026-08-15T16:51:54.950442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.655169Z","title":"Badacts: A universal backdoor de- fense in the activation space.Findings of the Association for Computational Linguistics: ACL 2024, 2024","venue":null,"work_id":"be67a7ac-c273-4461-a7b1-3bb2e48c9e07","year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.954800Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:32014a339504c902dda6b3eacfea8ca34afdf1cdfee95c08064408c5c68ccff5","observation_id":"1f63d085-240e-4322-9aff-635d01fe03ae","resolution":{"observed_at":"2026-08-15T16:51:55.659439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.642832Z","title":"Byzantine-robust distributed learning: Towards optimal statistical rates","venue":null,"work_id":"6ce53366-798e-4c96-afc9-de3183cceeed","year":2018},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.960041Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:546960ca2047a0ecdf54016713798701d4a45800b096b44bfbeb0f94d1b1da45","observation_id":"15e21656-9e67-4563-a7cc-8233a5166ccf","resolution":{"observed_at":"2026-08-15T16:51:55.647006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.631662Z","title":"CLIBE: Detecting dynamic back- doors in transformer-based nlp models","venue":null,"work_id":"44d7cf98-24b0-491e-b486-aa2ab911e1b6","year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.964550Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:78191044353cd189f3e098b66162bfa477246699a1d68296b3043655f8f6127f","observation_id":"50b8a017-09a9-476e-82fa-2173ed6903bb","resolution":{"observed_at":"2026-08-15T16:51:55.635556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13722","last_updated":"2024-10-17T16:27:13Z","snapshot_observed_at":"2026-08-16T13:08:20.718461Z","submitted_at":"2024-10-17T16:27:13Z","title":"Persistent Pre-Training Poisoning of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13722","snapshot_observed_at":"2026-08-15T16:51:54.969388Z","title":"Persistent pre-training poisoning of llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.969388Z"},"links":{"cited_paper":"/paper/2410.13722","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:f6517846c20f46edd4adf5bdeffed5646be428d93ce36a0dabbd6181ee908cca","observation_id":"2a43c7fe-abc1-4ec4-9863-4759915f00b2","resolution":{"observed_at":"2026-08-15T16:51:54.969388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12736","last_updated":"2024-07-03T06:13:31Z","snapshot_observed_at":"2026-08-16T14:33:07.599020Z","submitted_at":"2023-12-20T03:18:50Z","title":"Learning and Forgetting Unsafe Examples in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12736","snapshot_observed_at":"2026-08-15T16:51:54.975579Z","title":"Learning and forgetting unsafe examples in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.975579Z"},"links":{"cited_paper":"/paper/2312.12736","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:013b28e30478d592d3417143966f32d382e1c0f34a54116220f36975a97cbef8","observation_id":"d12a7817-57a1-460c-95f7-ee4881b46508","resolution":{"observed_at":"2026-08-15T16:51:54.975579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06315","last_updated":"2023-12-11T12:02:14Z","snapshot_observed_at":"2026-08-17T07:39:37.763381Z","submitted_at":"2023-12-11T12:02:14Z","title":"GPTBIAS: A Comprehensive Framework for Evaluating Bias in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06315","snapshot_observed_at":"2026-08-15T16:51:54.980320Z","title":"Gptbias: A comprehensive frame- work for evaluating bias in large language models.arXiv preprint arXiv:2312.06315, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.980320Z"},"links":{"cited_paper":"/paper/2312.06315","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:a7b23edd456208bba1fe86f65fafe6d2a03e6aee965740dd1c00fe1786b82ffa","observation_id":"e6332d89-bc9f-40d1-a1d2-81d7bceab443","resolution":{"observed_at":"2026-08-15T16:51:54.980320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.984985Z","title":"Judging llm-as- a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.984985Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:51f14da03f450fa69a50e593aee67de9224eb8cc23b3c74878407882f8ef1aad","observation_id":"7d8afa5e-51ff-4216-8c24-fdfbd2b55bb5","resolution":{"observed_at":"2026-08-15T16:51:54.984985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00446","last_updated":"2026-04-05T08:03:35Z","snapshot_observed_at":"2026-08-13T14:52:27.707325Z","submitted_at":"2025-04-01T05:58:14Z","title":"Exposing the Ghost in the Transformer: Abnormal Detection for Large Language Models via Hidden State Forensics","version":2},"cited_work":{"arxiv_id":"2504.00446","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.00446","snapshot_observed_at":"2026-08-15T16:51:55.087075Z","title":"Exposing the Ghost in the Transformer: Abnormal Detection for Large Language Models via Hidden State Forensics","venue":"cs.CR","work_id":"c37771ac-5998-4803-a86c-882066fb96ea","year":2025},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.989531Z"},"links":{"cited_paper":"/paper/2504.00446","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:3f04a2652b67c9ad280e2244feb0c14a8cfadd978ffbd7c0bcb630780ba3ce79","observation_id":"d78fd001-b955-43a3-9083-e9243b71e0c4","resolution":{"observed_at":"2026-08-15T16:51:55.094730Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-15T16:51:54.996034Z","title":"Universal and trans- ferable adversarial attacks on aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.996034Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:8749d8d20804e45694ebbd16a7f08222e24e7297932bbc76820dc34cbc9a4632","observation_id":"85669597-3741-4901-888b-f3b353235182","resolution":{"observed_at":"2026-08-15T16:51:54.996034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.613650Z","title":"Consider min π: π(Rx|x)=α KL π(·| x)∥ π0(·| x)","venue":null,"work_id":"7a43fa46-b169-4898-88c6-f677425246fd","year":null},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:55.001262Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:dec410589d764e066e132bc8f8829f362aa97f7f5c17f6b0e68f03b9b81eba9b","observation_id":"b53c36f2-603f-46f8-bba2-4bfa96edf11f","resolution":{"observed_at":"2026-08-15T16:51:55.617215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.601939Z","title":null,"venue":null,"work_id":"5804d1eb-02e7-4f92-b643-62aaf1b1aa39","year":null},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:55.005747Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:6a11d9df643d1bb89f9232d55dfe6a89ecfe43d8903d7239474b554559eaa301","observation_id":"ae4cab25-0222-424f-adb1-9285cd405d1f","resolution":{"observed_at":"2026-08-15T16:51:55.606062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:55.589309Z","title":"increase","venue":null,"work_id":"7dd0a852-b908-42ee-afa6-793517a94bcb","year":null},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:55.010456Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:c282ebf0a5251cc62ad8c31da897ec2bafdc81b4daeefa2f8d523351934fc5cd","observation_id":"c49ddc30-0d03-4365-8eb9-2f099f40a4cb","resolution":{"observed_at":"2026-08-15T16:51:55.593148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:54.645194Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:54.645194Z"},"links":{"citing_paper":"/paper/2508.20333"},"observation_digest":"sha256:c692b9d0b2c717e4c2ec5d9b5999d06ed49a905fe3d76a0130e005b617667514","observation_id":"ddf6c29e-9790-4ef1-ae19-43c4beb22c35","resolution":{"observed_at":"2026-08-15T16:51:54.645194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.20333","last_updated":"2025-08-28T00:30:25Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T16:44:24.168196Z","submitted_at":"2025-08-28T00:30:25Z","title":"Poison Once, Refuse Forever: Weaponizing Alignment for Injecting Bias in LLMs"},"reference_resolution":{"displayed":92,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":60,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":92},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 92 of 92 outbound references and 0 inbound Pith citation observations for arXiv:2508.20333."}