{"as_of":"2026-08-12T16:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e19992aade0bea0940dfdaa6e1fd0a5205d13ecd69ad56e0c43079d9285feaba","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:18:53.661855Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01414/citation-record","integrity":"/paper/2608.01414/integrity","json":"/paper/2608.01414/citation-record.json","paper":"/paper/2608.01414"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-06T00:18:47.641655Z","title":"Hewett, Mojan Javaheripi, Piero Kauffmann, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:47.641655Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:4161dddb318718ec369f80cbb7113dc0016ff23f15522d12a11e7a060812bd0d","observation_id":"1f600858-8d64-49c6-a2d6-d67d271eb025","resolution":{"observed_at":"2026-08-06T00:18:47.641655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:19:01.041255Z","title":"Refusal in language models is mediated by a single direction","venue":null,"work_id":"f4768d55-3928-440b-9a8c-84c46c076245","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:47.790026Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:0efd48249e79341c7bd068a4d173f7585a5f2a14b16230e48c6c195b7bcb0f5b","observation_id":"90e3ad4a-aa29-4c3c-8322-fc053dbcbf88","resolution":{"observed_at":"2026-08-06T00:19:01.147174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:47.909570Z","title":"Qwen technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:47.909570Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:efd6139c26f9b33291dc040dbc2526602528565e6e7fc99e47b8c85a21bddc7f","observation_id":"84f80de4-8a14-447b-9b6a-96163838e204","resolution":{"observed_at":"2026-08-06T00:18:47.909570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:48.015481Z","title":"Qwen2.5-vl technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.015481Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:a320c1e8ac9f4b5b61a32422d61753ddd5c6ad05cf1beeb484554c355750474d","observation_id":"4074e66f-a830-4527-aeae-d624851a7bd2","resolution":{"observed_at":"2026-08-06T00:18:48.015481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-06T00:18:48.167155Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback.arXiv preprint arXiv:2204.05862, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.167155Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:55be1b8225dac40309722fb2602d374e4678e9cd59ae114de21989ab2b78c6b1","observation_id":"1ce0f009-250b-4a6d-9397-5e55f263ec5f","resolution":{"observed_at":"2026-08-06T00:18:48.167155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-06T00:18:48.335534Z","title":"Mechanistic interpretability for ai safety–a review.arXiv preprint arXiv:2404.14082, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.335534Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:16685890503ff49731c4997211e0d8d5b6cfd2f70dd18c89f749738c3700eeee","observation_id":"3c523e77-2bcf-4195-86f6-0f3d87f8611d","resolution":{"observed_at":"2026-08-06T00:18:48.335534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:48.427125Z","title":"Language models are Homer simpson! safety re-alignment of fine-tuned language models through task arithmetic","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.427125Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:a397cfe4af95378814c623b218c3cca0dcbc7d646c52fba94b597653a3ca3c95","observation_id":"3c2733ef-2b62-43f7-8dba-730a14994635","resolution":{"observed_at":"2026-08-06T00:18:48.427125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09662","last_updated":"2023-08-30T10:21:00Z","snapshot_observed_at":"2026-08-12T05:31:18.633255Z","submitted_at":"2023-08-18T16:27:04Z","title":"Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09662","snapshot_observed_at":"2026-08-06T00:18:48.516596Z","title":"Red-teaming large language models using chain of utterances for safety-alignment.arXiv preprint arXiv:2308.09662, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.516596Z"},"links":{"cited_paper":"/paper/2308.09662","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:8ed832156d9d8f6233c0bd9cf0fc65ad6eb5bce96a75b2dca9200a86228a856b","observation_id":"a8e4ed37-5070-4455-b867-09c47f93ea5b","resolution":{"observed_at":"2026-08-06T00:18:48.516596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:19:00.666177Z","title":"Brown et al","venue":null,"work_id":"48970c7d-da05-4b85-ab58-0e1a98585915","year":1901},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.616841Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:2faf595da0cc8619db76acec806685f550f26d6dd94bed23cdb4ffa9503a1c78","observation_id":"392568be-bb36-4c6b-a44b-9b8c8ead0abb","resolution":{"observed_at":"2026-08-06T00:19:00.861651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:19:00.373148Z","title":"Towards understanding safety alignment: A mechanistic perspective from safety neurons","venue":null,"work_id":"8f7b3473-2dcc-492b-9957-da667d3b4111","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.747271Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:d5be960ed31aea0f096244c1ac4e6aa6419116bd9845029b3dfeb40ee927d88d","observation_id":"a82b5044-2036-4a88-b5c9-3d237b593f6e","resolution":{"observed_at":"2026-08-06T00:19:00.512350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:59.956020Z","title":"Think you have solved question answering? try ARC, the AI2 reasoning challenge, 2018","venue":null,"work_id":"5089d025-a3ca-40ac-9a58-9079805b6948","year":2018},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.913473Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:e7b0b2f080eae2026eee5e376aab56e77003269a09eadd8d7fea303a71a65959","observation_id":"099a1440-6997-43b3-840a-86ce3e9ea498","resolution":{"observed_at":"2026-08-06T00:19:00.155206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:49.043158Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.043158Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:912531ce4e2a2c88389c35335b125b87045b81be2b147559b7e4a912489276a0","observation_id":"d799eba4-ccc5-4f82-8abb-6a5162de9a0f","resolution":{"observed_at":"2026-08-06T00:18:49.043158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:49.155369Z","title":"Dna: Uncovering universal latent forgery knowledge.arXiv preprint arXiv:2601.22515, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.155369Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:2a8af9899ae68a92f74c8871a37fb76ab0b37fde245b0383ce632908f3e1840d","observation_id":"9497005e-7db5-4842-bdde-59636bd6558f","resolution":{"observed_at":"2026-08-06T00:18:49.155369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-06T00:18:49.251487Z","title":"Gemma: Open models based on gemini research and technology.arXiv preprint arXiv:2403.08295, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.251487Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:f23abf64c5d433bdcfa740b3ef5d129cda4856f4557cd1e7d313cdcfe3028f1b","observation_id":"7329596c-6e32-404e-8807-106b89078f3f","resolution":{"observed_at":"2026-08-06T00:18:49.251487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:59.605984Z","title":"FigStep: Jailbreaking large vision-language models via typographic visual prompts","venue":null,"work_id":"b264fdbb-7253-41a0-95f9-4c9b44d122ce","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.356894Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:7a4b1fb239ba6b3fe0c81864aaae9e0fd51f56d7c7ef0d7322b9aa0bab995cf6","observation_id":"afe3a815-d650-4634-8ae1-922834e6efcf","resolution":{"observed_at":"2026-08-06T00:18:59.736632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:49.592647Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.592647Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:3541fc6793b0aed21ae002ea0b6727d6d4eb4eba4a54e1a5fb58774949795b8b","observation_id":"a3904cd3-be16-40e6-ab81-a1f911ef0b4f","resolution":{"observed_at":"2026-08-06T00:18:49.592647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T00:18:49.709052Z","title":"DeepSeek-R1: Incentivizing reasoning capability in LLMs via reinforce- ment learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.709052Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:301613132e256455eb24b7a8ec7b795bbddf4f22198a09b6f9aac2c6100b9933","observation_id":"965dcc06-edae-409d-a29e-d0eabdd9e20e","resolution":{"observed_at":"2026-08-06T00:18:49.709052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:49.818291Z","title":"PKU-SafeRLHF: Towards multi- level safety alignment for LLMs with human preference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.818291Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:63112a857dc5b5e68a01a90fd4aac3f2656ebeeceba0d5fd54c3e13d424a4d8a","observation_id":"b3cac4d5-8985-4e00-974c-21b577d2d13d","resolution":{"observed_at":"2026-08-06T00:18:49.818291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:59.371326Z","title":null,"venue":null,"work_id":"737a5e85-966f-44f4-ad9c-40931edcacfe","year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.948433Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:2876b5f542b45d2fb4088b0f9021fe6baeb35a47397fe65372fc80ca741408cd","observation_id":"a5a78fc4-7c1b-4f4b-8762-7559e5ee21e5","resolution":{"observed_at":"2026-08-06T00:18:59.462162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:59.125298Z","title":"Li, Ann-Kathrin Dombrowski, Shashwat Goel, Long Phan, et al","venue":null,"work_id":"6ed11d06-689f-4aab-a9ed-8c44822a2846","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.077899Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:0c0d1938698e4c92302e23220fbdf0a7ceacc59a977e252f79dc9e15cc1369b2","observation_id":"9efe5ece-fc1d-4b04-a61f-183b40f76cd2","resolution":{"observed_at":"2026-08-06T00:18:59.246967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:58.883754Z","title":"Images are achilles’ heel of alignment: Exploiting visual vulnerabilities for jailbreaking multimodal large language models","venue":null,"work_id":"6cfc9394-2456-4e19-8ffc-48237aa30ef9","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.254018Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:35f0df5115286078b395789cd01ebb903478cbf8c410f00b4511139cc68ec98a","observation_id":"391afc04-b9e6-4eea-b279-73d6226f29f5","resolution":{"observed_at":"2026-08-06T00:18:59.008836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:58.623968Z","title":"TruthfulQA: Measuring how models mimic human falsehoods","venue":null,"work_id":"e2a0977a-f925-46cc-a84a-1dcb9f92f688","year":2022},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.386078Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:623f4e2d61d5f38208eea8e405b60effdd4e6f9e28432b81e35119dbb8edd12e","observation_id":"95d81f17-dbd3-4b39-8784-51c43cd96727","resolution":{"observed_at":"2026-08-06T00:18:58.773225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:50.496181Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.496181Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:e363d2e7f2a218ba5577d327f4142e717cd8f279fd429a4c7fcdcd0d177dd958","observation_id":"b5f373f9-07a4-4730-bcde-6323a666b9bb","resolution":{"observed_at":"2026-08-06T00:18:50.496181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:50.613801Z","title":"MMBench: Is your multi-modal model an all- around player?, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.613801Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:ef8ee89b910dde80fa1f153d268e0fab11d87995d6c811ec27a8d986162b5f49","observation_id":"642773eb-c65f-414d-ba00-0ccf0ba78eef","resolution":{"observed_at":"2026-08-06T00:18:50.613801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:50.721583Z","title":"Decoupled weight decay regulariza- tion","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.721583Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:6e8c176a64deea0569e0afc47ec5b36dae6bf872a5c89e4a431a23fccec72f86","observation_id":"517f68ac-7397-4396-b81b-ca04a9826e64","resolution":{"observed_at":"2026-08-06T00:18:50.721583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:58.248084Z","title":"HarmBench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":"1fe81288-a109-49bb-b2a3-d802d180024c","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.847333Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:258c1f985f87215889a046e9ad6ea468cdc2bf9d9affdf0c18efe3cde5c58103","observation_id":"36e0cc30-eb5d-471d-84cc-5cd5421fb6a2","resolution":{"observed_at":"2026-08-06T00:18:58.433158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:57.857131Z","title":"Pruning convolutional neural networks for resource efficient inference","venue":null,"work_id":"926d0cb8-b2f1-40f9-8b23-8e43790c5b13","year":2017},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.993536Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:00955fa6a8ec195401236f651b9d931e026e9ae3f75573bcd05a55f4d7417f16","observation_id":"83054a01-f0cd-4ff9-a024-7392f6604c96","resolution":{"observed_at":"2026-08-06T00:18:58.072871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:57.486839Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"2ac60df2-4bf5-4447-b5a4-74c4553ea29f","year":2022},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.108876Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:55e4a1468f969a2bafd3b20788def42f282b02949af1ed55b1d8abee917bde46","observation_id":"777b2304-c637-43ff-89cf-f44664ae95d7","resolution":{"observed_at":"2026-08-06T00:18:57.645617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:57.087731Z","title":"Representation noising: A defence mech- anism against harmful finetuning","venue":null,"work_id":"3341c8c8-267d-404a-ac44-5b24d7b068e5","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.280048Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:03fe68dde0d314b4c02ca353c0018aad085d0c6e470893dd1d366beb260d8657","observation_id":"67ad9ef2-ede9-4589-83c2-ac872a61d6fc","resolution":{"observed_at":"2026-08-06T00:18:57.275855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:56.794923Z","title":"XSTest: A test suite for identifying exaggerated safety behaviours in large language models","venue":null,"work_id":"39c08b6e-1137-41c8-a74c-80b76504c754","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.435864Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:51b9f2b32703641785161f1babe5dafe0ca349e124e813865f56f11bb355675b","observation_id":"3874d651-a443-4ef3-a1ff-56db695739b6","resolution":{"observed_at":"2026-08-06T00:18:56.952210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15549","last_updated":"2025-07-29T09:37:22Z","snapshot_observed_at":"2026-08-06T22:31:48.025702Z","submitted_at":"2024-07-22T11:19:14Z","title":"Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15549","snapshot_observed_at":"2026-08-06T00:18:51.590300Z","title":"Latent adversarial training improves robustness to persistent harmful behaviors in LLMs.arXiv preprint arXiv:2407.15549, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.590300Z"},"links":{"cited_paper":"/paper/2407.15549","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:2e48dde63797a78be716391cc4496e359de5f5dbe1e1a20307fcbfebe72d0d3e","observation_id":"b45e36db-5e0f-406e-a599-c1632c39a1f4","resolution":{"observed_at":"2026-08-06T00:18:51.590300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:51.980020Z","title":"Where culture fades: revealing the cultural gap in text-to-image generation.arXiv preprint arXiv:2511.17282, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.980020Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:907cf66ea125cef497b00383746f941ce234191563581d5dec9a9bd74a70e91e","observation_id":"0382d27c-9de5-4212-a464-d3152fe14255","resolution":{"observed_at":"2026-08-06T00:18:51.980020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:56.450100Z","title":"TraceRouter: Robust safety for large foundation models via path-level intervention","venue":null,"work_id":"15c80939-0e20-40b1-8d09-00ce26f8f9df","year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.226014Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:24538a54a1f9ff50ca16c13f66634d9886f1410c4aaa85effab45fdf13dbc8f6","observation_id":"f1ad0204-b8c7-497d-be98-9ce6e5cde755","resolution":{"observed_at":"2026-08-06T00:18:56.579897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.311850Z","title":"Orthoeraser: coupled-neuron orthogonal projection for concept erasure.arXiv preprint arXiv:2603.11493, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.311850Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:b4a819f3ad2c332d5a1d34be2411bc0af3f5b596860630970de2bbf3160d56f4","observation_id":"c64ee951-f054-4f4e-8519-3ab80e966c19","resolution":{"observed_at":"2026-08-06T00:18:52.311850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10260","snapshot_observed_at":"2026-08-06T00:18:52.404593Z","title":"A StrongREJECT for empty jailbreaks.arXiv preprint arXiv:2402.10260, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.404593Z"},"links":{"cited_paper":"/paper/2402.10260","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:a42f89f4d782b32ed0680fb74f8e02a8ff5722da1b67366dd40671e06b68b6de","observation_id":"51dcc1f5-2ec3-4bba-abf7-f0e651ef2a17","resolution":{"observed_at":"2026-08-06T00:18:52.404593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.471514Z","title":"Dropout: A simple way to prevent neural networks from overfitting.Journal of Machine Learning Research, 15(56):1929–1958, 2014","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.471514Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:4ec299142cd5f08e99140f00ca75dd2b13767c1f95b3e9c7733cd24233ad9247","observation_id":"7018b5b6-ffcc-434f-8f23-acb594ded70c","resolution":{"observed_at":"2026-08-06T00:18:52.471514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.559100Z","title":"Zico Kolter","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.559100Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:829f05ca00ad9bcf8c0a4a245c4a4fb1e39c6a9f692ddb89c5d6760d2a0ee35b","observation_id":"77401e9b-678a-40dc-9eaa-01507ef87998","resolution":{"observed_at":"2026-08-06T00:18:52.559100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:56.048413Z","title":"Zico Kolter","venue":null,"work_id":"cef59576-5c89-4497-bbf6-5a20e7960490","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.637182Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:279db36b94a023da71959e5a2820efb1f4c1f4a530baa06703078d3ae62d3dd7","observation_id":"3844070b-028c-4aed-b328-806cd2808c4f","resolution":{"observed_at":"2026-08-06T00:18:56.252598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.703131Z","title":"SafeNeuron: Neuron- level safety alignment for large language models.arXiv preprint arXiv:2602.12158, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.703131Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:1eef625730283b2a1bbe6457ea95941859d32139729bae575ac79237516f511f","observation_id":"5881ff72-767d-43ea-ad4a-d7f368a58b0b","resolution":{"observed_at":"2026-08-06T00:18:52.703131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.787762Z","title":"Taxonomy, opportunities, and challenges of representation engi- neering for large language models.arXiv preprint arXiv:2502.19649, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.787762Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:cfcffafdba2a16e3d2cc0af1685b8b77695284be41fda34328aa5f660bf2d945","observation_id":"4d07861b-3234-4a57-b119-647180c55b74","resolution":{"observed_at":"2026-08-06T00:18:52.787762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:55.699679Z","title":"Jailbroken: How does LLM safety training fail? InAdvances in Neural Information Processing Systems, volume 36, 2023","venue":null,"work_id":"ebea8fe4-a797-40a5-bed4-149ff5380d72","year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.858768Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:ec06641f77eb2742e8f6f262dad158b0ea2116f1bb6981e63bd055fd021a9990","observation_id":"b650a3e8-a2df-4c1a-b276-41f8ed9d33ba","resolution":{"observed_at":"2026-08-06T00:18:55.871548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:55.214260Z","title":"NeuroStrike: Neuron-level attacks on aligned LLMs","venue":null,"work_id":"f646603f-d402-4976-93a9-e91aafdb5ce1","year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.926634Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:c0a0bca3b6633d15a343dbdb696b43d0274aed1a2ed91059dac77824ea8d1223","observation_id":"4f1293c3-bd93-43c6-a8d7-123bee059ef4","resolution":{"observed_at":"2026-08-06T00:18:55.461925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:55.010846Z","title":"NLSR: Neuron-level safety realignment of large language 9 models against harmful fine-tuning","venue":null,"work_id":"6538d054-e1d3-46b2-9097-dbba1326e2e3","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.993493Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:5ba10cdaa3842142aba7a812f7c11799a3c0d110a28770e2d7b9a22c80a19320","observation_id":"11b3413a-478c-4fd6-9f1d-e45d8ad267b3","resolution":{"observed_at":"2026-08-06T00:18:55.100559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:54.813059Z","title":"Representation bending for large language model safety","venue":null,"work_id":"dae3d7a4-c6c4-408f-8aec-bd6cf917e8f6","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.071474Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:4891295b26b2cb46f1cb245529fc18751493dbe9c2bc7230b2bde1b9601eec35","observation_id":"b4639a0e-6f5b-4dbe-8f57-3ad4a739267c","resolution":{"observed_at":"2026-08-06T00:18:54.924763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:54.552356Z","title":"Weston, and Xian Li","venue":null,"work_id":"51dfb8e5-d05a-4f16-80c9-3f7f9d88253e","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.303482Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:0e51dbac52b4b654d7803a329388d8fce485cc556fe177ec929f72ceca07265c","observation_id":"433c468d-dbc8-42b1-8e23-0e716e9f8166","resolution":{"observed_at":"2026-08-06T00:18:54.675581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:54.355084Z","title":"Understanding and enhancing safety mechanisms of LLMs via safety-specific neuron","venue":null,"work_id":"1f544680-303c-4af6-9752-1387b947770b","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.415568Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:52835954ff27b9b1245469a8dca2b15f57039423d59e56e68e0d55eba54ace73","observation_id":"dc92f761-cf4f-40ed-91ff-dfb68f534e9c","resolution":{"observed_at":"2026-08-06T00:18:54.473399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04313","last_updated":"2024-07-12T16:51:07Z","snapshot_observed_at":"2026-08-10T19:22:05.434817Z","submitted_at":"2024-06-06T17:57:04Z","title":"Improving Alignment and Robustness with Circuit Breakers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04313","snapshot_observed_at":"2026-08-06T00:18:53.554407Z","title":"Zico Kolter, Matt Fredrik- son, and Dan Hendrycks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.554407Z"},"links":{"cited_paper":"/paper/2406.04313","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:bc2119fe8c918f4754c15fc5f0ea18fbcbb7ada31cf45cd4c5f211dcafddabb2","observation_id":"552e4e83-f8bc-4208-a42c-770f591127eb","resolution":{"observed_at":"2026-08-06T00:18:53.554407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T00:18:53.661855Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.661855Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:d654a5f64b5d4f19cd988f8147c85bffd3326fff6e08b1a9486c02037b44720b","observation_id":"c28e9822-e015-46e2-99c6-67dbb638237f","resolution":{"observed_at":"2026-08-06T00:18:53.661855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T23:34:22.683191Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2608.01414."}