{"as_of":"2026-08-20T08:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f63bbcdcac33fbdd117f5635587589392f07f1a07e95023c38cb5253a8f6326a","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T12:52:40.970136Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:21:58.795021Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T08:26:48.381752Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16497","snapshot_observed_at":"2026-08-15T16:21:58.795021Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06338","last_updated":"2025-09-08T05:00:58Z","snapshot_observed_at":"2026-08-19T04:52:07.684642Z","submitted_at":"2025-09-08T05:00:58Z","title":"Embedding Poisoning: Bypassing Safety Alignment via Embedding Semantic Shift","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T16:21:58.795021Z"},"links":{"cited_paper":"/paper/2501.16497","citing_paper":"/paper/2509.06338"},"observation_digest":"sha256:81eceb1713d1e4fad01f74d4ae5a2c44b43221943e41b6d78611eb172d2b0d3e","observation_id":"a4037bb0-48ea-40e9-9565-1e8456f2da7a","resolution":{"observed_at":"2026-08-15T16:21:58.795021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"cited_work":{"arxiv_id":"2501.16497","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16497","snapshot_observed_at":"2026-07-02T08:26:48.381752Z","title":"org/abs/2501.16497","venue":null,"work_id":"46311102-5dc7-415e-8b99-27ba1966660a","year":2025},"citing_paper":{"arxiv_id":"2604.18756","last_updated":"2026-04-20T19:00:09Z","snapshot_observed_at":"2026-08-14T07:51:40.546112Z","submitted_at":"2026-04-20T19:00:09Z","title":"Towards Understanding the Robustness of Sparse Autoencoders","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T05:44:24.532548Z"},"links":{"cited_paper":"/paper/2501.16497","citing_paper":"/paper/2604.18756"},"observation_digest":"sha256:1728c30255a742c4b8c9a664cb84878ce5f9af5fca740fc931138dc93a3a12d6","observation_id":"f5aeb4fb-04a5-4fb2-a084-f490918a8417","resolution":{"observed_at":"2026-05-10T05:46:10.252295Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"cited_work":{"arxiv_id":"2501.16497","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16497","snapshot_observed_at":"2026-07-02T08:26:48.381752Z","title":"org/abs/2501.16497","venue":null,"work_id":"46311102-5dc7-415e-8b99-27ba1966660a","year":2025},"citing_paper":{"arxiv_id":"2605.10611","last_updated":"2026-05-11T14:09:31Z","snapshot_observed_at":"2026-08-02T15:29:13.025199Z","submitted_at":"2026-05-11T14:09:31Z","title":"Re-Triggering Safeguards within LLMs for Jailbreak Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T04:37:29.075413Z"},"links":{"cited_paper":"/paper/2501.16497","citing_paper":"/paper/2605.10611"},"observation_digest":"sha256:e0450de30663989088512d59451f0db3fe21bd901c26e6f04f2b7d98acd01807","observation_id":"23f0ab69-a308-4108-b653-dec1e85b3c01","resolution":{"observed_at":"2026-05-12T06:06:25.023194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"cited_work":{"arxiv_id":"2501.16497","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16497","snapshot_observed_at":"2026-07-02T08:26:48.381752Z","title":"org/abs/2501.16497","venue":null,"work_id":"46311102-5dc7-415e-8b99-27ba1966660a","year":2025},"citing_paper":{"arxiv_id":"2606.04717","last_updated":"2026-06-10T09:03:21Z","snapshot_observed_at":"2026-08-12T20:21:39.657285Z","submitted_at":"2026-06-03T10:49:43Z","title":"Auditing CoT Answer-Hijack Patches: Source-Control Certificates with Type-I Guarantees","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T06:00:46.938039Z"},"links":{"cited_paper":"/paper/2501.16497","citing_paper":"/paper/2606.04717"},"observation_digest":"sha256:f8e7b9c900a6634f6af6b1b17a11813ffd40af2a410747e67f991289a0f0bc0f","observation_id":"3a320c02-371d-4654-af67-062bf117574a","resolution":{"observed_at":"2026-07-02T08:26:48.383245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.16497/citation-record","integrity":"/paper/2501.16497/integrity","json":"/paper/2501.16497/citation-record.json","paper":"/paper/2501.16497"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-10T12:52:40.901600Z","title":"Jailbreaking black box large language models in twenty queries","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.901600Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:2a60c6721677969eea8f407fdb06dd244a68a1eee33ed0e3e83d67ab5fd24160","observation_id":"cddc8ebe-d7a3-4923-a5e4-b3493db63cd9","resolution":{"observed_at":"2026-08-10T12:52:40.901600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-11T16:28:21.917686Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-10T12:52:40.906279Z","title":"JailbreakBench: An open robustness benchmark for jailbreaking large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.906279Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:06c3770514f7c4e15177fe9ecdfd27a82d4d63dcc55f49f8ae0ef07160d11ba9","observation_id":"55507cc1-c7c8-4152-a8d3-8dbb6791a3f4","resolution":{"observed_at":"2026-08-10T12:52:40.906279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-10T12:52:40.918088Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.918088Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:adeca13f5ade4ae58574dd89a9dc2ecc153f4de453a13f034632536a6e540793","observation_id":"771fb426-63a2-494e-9124-f89507a13361","resolution":{"observed_at":"2026-08-10T12:52:40.918088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-10T12:52:40.921697Z","title":"Baseline defenses for adversarial attacks against aligned language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.921697Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:d8ae93d014fa45bc9b90daea01178b0638d07a3ac88a5dd6b2f3f48704a3f883","observation_id":"41b4c813-94a4-414c-88ef-f7b0c896e911","resolution":{"observed_at":"2026-08-10T12:52:40.921697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16192","last_updated":"2024-02-28T23:11:33Z","snapshot_observed_at":"2026-08-19T03:06:30.029191Z","submitted_at":"2024-02-25T20:36:03Z","title":"Defending Large Language Models against Jailbreak Attacks via Semantic Smoothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16192","snapshot_observed_at":"2026-08-10T12:52:40.925285Z","title":"Defending large language models against jailbreak attacks via semantic smoothing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.925285Z"},"links":{"cited_paper":"/paper/2402.16192","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:d043f5532ed865bc3998af4b9a8b6c63fb6ceef970a2b1821276674da22acfa4","observation_id":"5b723e18-9619-4d71-9548-821801dbacb8","resolution":{"observed_at":"2026-08-10T12:52:40.925285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02705","last_updated":"2025-02-04T19:47:09Z","snapshot_observed_at":"2026-08-19T18:59:35.297879Z","submitted_at":"2023-09-06T04:37:20Z","title":"Certifying LLM Safety against Adversarial Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02705","snapshot_observed_at":"2026-08-10T12:52:40.928821Z","title":"Certifying LLM safety against adversarial prompting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.928821Z"},"links":{"cited_paper":"/paper/2309.02705","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:61fbc8c0207ace481d938d2de0883a4c84a612ad4ede69061035a2a489c65be9","observation_id":"edc496c7-288c-4817-adef-d181b7edf0c2","resolution":{"observed_at":"2026-08-10T12:52:40.928821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:52:40.932369Z","title":"Certified robustness to adversarial examples with differential privacy","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.932369Z"},"links":{"citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:065e0653e70e069107ca99d33986a28470fa2d5e127307929118d2c231d0855b","observation_id":"a7bf8c9c-f92d-4333-aa04-34ba76ba72c5","resolution":{"observed_at":"2026-08-10T12:52:40.932369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T12:52:40.936140Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.936140Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:189debd373aa19707b79179283240c0ec6d77a8bfa833b890d54dc14e3075ccb","observation_id":"c674cead-cb03-4c3a-af86-32cd35e037b1","resolution":{"observed_at":"2026-08-10T12:52:40.936140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-10T12:52:40.939580Z","title":"HarmBench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.939580Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:c952e0106971fed96e51fa1ddcd580ca7f05e8d290c1a534395dfc9660daf895","observation_id":"7b0efcbd-0fed-4e74-a645-366594bc9cba","resolution":{"observed_at":"2026-08-10T12:52:40.939580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13031","last_updated":"2024-07-23T22:56:13Z","snapshot_observed_at":"2026-08-20T02:52:47.433585Z","submitted_at":"2024-03-19T07:25:02Z","title":"RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13031","snapshot_observed_at":"2026-08-10T12:52:40.950778Z","title":"Rigor- LLM: Resilient guardrails for large language models against undesired content","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.950778Z"},"links":{"cited_paper":"/paper/2403.13031","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:76336b13db4d6d0d2d7aee4eddc5e567050b5ec345972e6df24cb61fdb7f11c6","observation_id":"acfdb9bd-c0c1-4c3d-917e-4abc7ae5493f","resolution":{"observed_at":"2026-08-10T12:52:40.950778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07171","last_updated":"2023-07-14T05:40:24Z","snapshot_observed_at":"2026-08-16T15:16:19.633945Z","submitted_at":"2023-07-14T05:40:24Z","title":"Certified Robustness for Large Language Models with Self-Denoising","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07171","snapshot_observed_at":"2026-08-10T12:52:40.954479Z","title":"Certified robustness for large language models with self-denoising","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.954479Z"},"links":{"cited_paper":"/paper/2307.07171","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:33133dd353b3b22caebee0a8a148b4ff0fb51132bb2113feace147b27e721627","observation_id":"a6ccf470-8148-4224-a140-da4f9f4c6297","resolution":{"observed_at":"2026-08-10T12:52:40.954479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-10T12:52:40.958213Z","title":"Instruction-following evaluation for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.958213Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:dd4c0a7a5182474f59db2ac186d8c47ba25cfdbbf21eaae27c7d93528cf7e73b","observation_id":"0a871956-3469-497e-9c05-198552ffdb80","resolution":{"observed_at":"2026-08-10T12:52:40.958213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-10T12:52:40.961922Z","title":"Universal and transferable adversarial attacks on aligned language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.961922Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:dec36c21c3e4f3313c86d780922dd20133439ef0af7ed3bc5dd6091cb0ecb42c","observation_id":"1ea8bff1-ff9d-4a21-b742-509db9db4b3f","resolution":{"observed_at":"2026-08-10T12:52:40.961922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:52:41.203408Z","title":"[USER-CONTENT]","venue":null,"work_id":"1fb5b7d5-35e5-4354-984e-378982fdf39d","year":2023},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.965842Z"},"links":{"citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:9cb2d833b58a9ece5cd6e93e08e64cc010191c4af2a7d6e055e3b5216d8496cb","observation_id":"eaec8b96-f231-411f-94f0-81063e48212a","resolution":{"observed_at":"2026-08-10T12:52:41.207625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:52:41.189225Z","title":"The results summarized in Table 2 show that 13 Figure 10: Process to get a response with a smoothed response prefix","venue":null,"work_id":"415fb9c9-c779-4c5e-87cc-df5fda50c345","year":2024},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.970136Z"},"links":{"citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:cfe4817aec2b257a1120b31b62265e77697114edb10e6d61e44d499fdf06883d","observation_id":"015894f3-18ac-4def-94e9-a82a6bbf0ad9","resolution":{"observed_at":"2026-08-10T12:52:41.195061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-08-15T16:41:15.505782Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-10T12:52:40.946943Z","title":"Hugo Touvron, Louis Martin, Kevin Stone, Peter Albert, Amjad Almahairi, Yasmine Babaei, Nikolay Bashlykov, Soumya Batra, Prajjwal Bhargava, Shruti Bhosale, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.946943Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:16706a799df22ce4ab4f7b1a36bca34397227742b6f8786879473673c03af3d1","observation_id":"28a6b165-b2ab-4ae8-bc6b-1dc2542a9e6e","resolution":{"observed_at":"2026-08-10T12:52:40.946943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-08-19T07:17:20.004918Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-10T12:52:40.914111Z","title":"org/abs/1412.6572","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.914111Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:5b9540790aaa1433402ab5d358127fefbaf7be9acb74fb6c4bf22325f26a61cb","observation_id":"685459c6-a38e-46cf-93a1-fc0532d84f3c","resolution":{"observed_at":"2026-08-10T12:52:40.914111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-10T12:52:40.910198Z","title":"Length-controlled AlpacaEval: A simple way to debias automatic evaluators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.910198Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:39e39a56bf9bdcc9eb6e131e518d1e49423e44dd996ce957ebd7552cec39a5d0","observation_id":"c4ad8d9a-a7a2-46bf-92f6-65d8d195a7dd","resolution":{"observed_at":"2026-08-10T12:52:40.910198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-08-17T15:25:03.596568Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-10T12:52:40.943356Z","title":"SmoothLLM: Defending large language models against jailbreaking attacks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.943356Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:d0c92961751e05f7c983d53bf6ab0063ae8ed002562fc4679a852f734b067af9","observation_id":"6b2fc66e-da60-4a7b-97b8-a89099a4423b","resolution":{"observed_at":"2026-08-10T12:52:40.943356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02151","last_updated":"2025-04-17T18:55:45Z","snapshot_observed_at":"2026-08-16T14:04:12.947538Z","submitted_at":"2024-04-02T17:58:27Z","title":"Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02151","snapshot_observed_at":"2026-08-10T12:52:40.897645Z","title":"Jailbreaking leading safety- aligned llms with simple adaptive attacks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.897645Z"},"links":{"cited_paper":"/paper/2404.02151","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:e9f399991b3bdf2877c4e6d6d65683c35fd8f550f370d137bbea6238ee42b425","observation_id":"1cc8c3c0-97d1-457c-b51e-7fe5aac8f70f","resolution":{"observed_at":"2026-08-10T12:52:40.897645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14132","last_updated":"2023-11-07T03:30:15Z","snapshot_observed_at":"2026-08-15T21:55:47.604051Z","submitted_at":"2023-08-27T15:20:06Z","title":"Detecting Language Model Attacks with Perplexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14132","snapshot_observed_at":"2026-08-10T12:52:40.893268Z","title":"Gabriel Alon and Michael Kamfonas","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T12:52:40.893268Z"},"links":{"cited_paper":"/paper/2308.14132","citing_paper":"/paper/2501.16497"},"observation_digest":"sha256:c9f64c197e38130fc88f4e2789f47325cf11872750dcff6ae843e6c3b84b4409","observation_id":"e9f69151-b8d8-4a66-990d-fb70ec011886","resolution":{"observed_at":"2026-08-10T12:52:40.893268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.16497","last_updated":"2025-01-27T20:57:26Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T20:21:25.789773Z","submitted_at":"2025-01-27T20:57:26Z","title":"Smoothed Embeddings for Robust Language Models"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 4 inbound Pith citation observations for arXiv:2501.16497."}