{"as_of":"2026-08-10T20:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53a007eacd3991499c3c79906f32486e08945b48f82e6c547375f6981e32d77a","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:34.927348Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-25T21:16:36.392606Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:30:07.677913Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"cited_work":{"arxiv_id":"2505.17078","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17078","snapshot_observed_at":"2026-07-04T19:30:07.677913Z","title":"arXiv preprint arXiv:2505.17078 , year=","venue":null,"work_id":"b885d1db-5d30-4905-93d7-ebf2324a85ef","year":null},"citing_paper":{"arxiv_id":"2606.25380","last_updated":"2026-06-24T04:24:30Z","snapshot_observed_at":"2026-08-03T19:47:13.872409Z","submitted_at":"2026-06-24T04:24:30Z","title":"A Survey of Toxicity Detection and Mitigation Strategies for Multilingual Language Models","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-06-25T21:16:36.392606Z"},"links":{"cited_paper":"/paper/2505.17078","citing_paper":"/paper/2606.25380"},"observation_digest":"sha256:f917ac0cacbe30316f6d878d9b6464c732b56e98c7ab0ce59071f4bff7ac2957","observation_id":"423b8540-b259-4a3e-b06f-2504de01f286","resolution":{"observed_at":"2026-07-04T19:30:07.679358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17078/citation-record","integrity":"/paper/2505.17078/integrity","json":"/paper/2505.17078/citation-record.json","paper":"/paper/2505.17078"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T15:42:29.664936Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.664936Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:8f9c935a9c85109ef5a19e811de00abff0f1d11924fe2b7d29e47e46d1506c8f","observation_id":"1d306a81-6087-4078-b15e-c9bb30816cd2","resolution":{"observed_at":"2026-08-07T15:42:29.664936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:29.746753Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.746753Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:a6f41832e15af3f7a77b366a053a555590470fdf4e0728521f0ce495f10a6cfa","observation_id":"f7ea174d-9138-4304-bff3-45199293e2e5","resolution":{"observed_at":"2026-08-07T15:42:29.746753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15349","last_updated":"2025-02-25T03:33:47Z","snapshot_observed_at":"2026-08-09T06:19:58.314147Z","submitted_at":"2024-05-24T08:42:40Z","title":"Everything is Editable: Extend Knowledge Editing to Unstructured Data in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15349","snapshot_observed_at":"2026-08-07T15:42:29.873282Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.873282Z"},"links":{"cited_paper":"/paper/2405.15349","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:e443c864e40c7218ca6014e6a0750eaf533b80485f949d654a7e3591dfb2d0a7","observation_id":"0030270b-98e4-4c25-ba40-54e871ad0c6b","resolution":{"observed_at":"2026-08-07T15:42:29.873282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06868","last_updated":"2025-02-08T04:47:17Z","snapshot_observed_at":"2026-08-08T19:14:27.409470Z","submitted_at":"2025-02-08T04:47:17Z","title":"Related Knowledge Perturbation Matters: Rethinking Multiple Pieces of Knowledge Editing in Same-Subject","version":1},"cited_work":{"arxiv_id":"2502.06868","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06868","snapshot_observed_at":"2026-08-07T15:42:35.824041Z","title":"Related Knowledge Perturbation Matters: Rethinking Multiple Pieces of Knowledge Editing in Same-Subject","venue":"cs.CL","work_id":"eb97ec0e-fa63-45d9-8a6f-30f9fa864a5b","year":2025},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.987832Z"},"links":{"cited_paper":"/paper/2502.06868","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:7452c58cda48c6ef2ee3fa6c40894113aecacb8b94b66e1bc024a38bcb3d9fcc","observation_id":"8bc8dc52-34b8-4476-9817-a1d9c6861d66","resolution":{"observed_at":"2026-08-07T15:42:35.937389Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:30.146022Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.146022Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:09ec53063bb5ff4947a4161d284f22dc40a99a920257cf118366d7107523707a","observation_id":"329266cd-b7eb-4096-baf3-9c10cca7b507","resolution":{"observed_at":"2026-08-07T15:42:30.146022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:30.234297Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.234297Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:a1540ea40296116f4917e54b3bc4311b45becb5545c800dedeb3a428ce6892f6","observation_id":"39c5fca4-d2dc-4489-847d-39654dee5017","resolution":{"observed_at":"2026-08-07T15:42:30.234297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:30.404467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.404467Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:d9616de294abc2db8787613575a3d97560a8ec0b7b29d7352af6d6660e09c77d","observation_id":"bf6c5531-3793-4654-8bf7-6ff5ccaa77cc","resolution":{"observed_at":"2026-08-07T15:42:30.404467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14913","last_updated":"2021-09-05T17:32:27Z","snapshot_observed_at":"2026-08-07T23:50:29.977330Z","submitted_at":"2020-12-29T19:12:05Z","title":"Transformer Feed-Forward Layers Are Key-Value Memories","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14913","snapshot_observed_at":"2026-08-07T15:42:30.575351Z","title":"Schuster, Jonathan Berant, and Omer Levy","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.575351Z"},"links":{"cited_paper":"/paper/2012.14913","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:c3c9ae41a627fa7f88d7eec7e48e18979ff4954482c99f10f8f3eb7d888beeb5","observation_id":"641ea04d-3d6a-4670-92a9-b9e6ef1cb70b","resolution":{"observed_at":"2026-08-07T15:42:30.575351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T15:42:30.761330Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.761330Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:4990513c4edf3e41503e80f1973a1322c998a3b39a3c6f8f77f3517026d8fb42","observation_id":"d18b0f2a-41c8-422e-8a51-3e892a8222cc","resolution":{"observed_at":"2026-08-07T15:42:30.761330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10543","last_updated":"2023-05-26T20:26:06Z","snapshot_observed_at":"2026-07-06T14:33:08.041820Z","submitted_at":"2022-12-20T18:50:00Z","title":"Detoxifying Text with MaRCo: Controllable Revision with Experts and Anti-Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10543","snapshot_observed_at":"2026-08-07T15:42:30.991971Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.991971Z"},"links":{"cited_paper":"/paper/2212.10543","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:9c5e5a8e76a078862143af13702e9dd9584d01650a459327fff1e7d7f462015f","observation_id":"9c46c601-880b-470b-8d8a-55e33dd258a3","resolution":{"observed_at":"2026-08-07T15:42:30.991971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T15:42:31.079246Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.079246Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:c7c52168dd31d39ecf8a826b37898d2dd1af1a1c3d236b201779e0207e92d599","observation_id":"ad8fa427-1c89-40f0-a84c-0d01ea855c41","resolution":{"observed_at":"2026-08-07T15:42:31.079246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:31.187270Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.187270Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:9bd2f8241bba6cd7f9a2a015da5dce15eafa7f36ebb1f29deb674a6e830218a2","observation_id":"c9e0a81d-3400-4da3-9421-f438f68c5b97","resolution":{"observed_at":"2026-08-07T15:42:31.187270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05858","last_updated":"2019-09-20T20:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-11T17:57:18Z","title":"CTRL: A Conditional Transformer Language Model for Controllable Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05858","snapshot_observed_at":"2026-08-07T15:42:31.288935Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.288935Z"},"links":{"cited_paper":"/paper/1909.05858","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:b412380dca160449aabd616561e655cd2dad629a79e61c46050056c2e4bed6a7","observation_id":"a47f9934-f65f-439d-95bb-433dd09c4b1e","resolution":{"observed_at":"2026-08-07T15:42:31.288935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:31.478253Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.478253Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:92cc1cba93ee415861b305785ff9e494f57f7dbf60524ae6c9840fecd1786569","observation_id":"51668387-e90c-4c23-9f51-2aa63e824fc6","resolution":{"observed_at":"2026-08-07T15:42:31.478253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:31.629100Z","title":"Kummerfeld, and Rada Mihalcea","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.629100Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:45817e7045eb109cb01dc9156aca16533989c466cdefa367d695cff6141e6fe5","observation_id":"be266ba5-146b-4df2-bf88-7669b297273f","resolution":{"observed_at":"2026-08-07T15:42:31.629100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:31.866816Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.866816Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:56ef9263431c202d914feaacce4b1b0b8cf8d6fa1b30bf65a2aec098ce6e758f","observation_id":"5458b9a1-d04a-4b6c-8d6f-a3446b74548a","resolution":{"observed_at":"2026-08-07T15:42:31.866816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05206","last_updated":"2026-04-14T16:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-02T05:14:22Z","title":"Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05206","snapshot_observed_at":"2026-08-07T15:42:32.063185Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:32.063185Z"},"links":{"cited_paper":"/paper/2502.05206","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:7a59b97b65eaa8a436091755325efc49d2a54d8f0614c5327e0a46ba96bc96bf","observation_id":"923982c6-6001-4ee4-9417-33db731489ac","resolution":{"observed_at":"2026-08-07T15:42:32.063185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06424","last_updated":"2025-06-08T13:49:52Z","snapshot_observed_at":"2026-07-06T19:48:00.661234Z","submitted_at":"2024-11-10T11:07:34Z","title":"How Does DPO Reduce Toxicity? A Mechanistic Neuron-Level Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06424","snapshot_observed_at":"2026-08-07T15:42:32.247738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:32.247738Z"},"links":{"cited_paper":"/paper/2411.06424","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:3e2fe0931a218a5da008a49eaec05abaedecd281b064d7e5fbbcb028c596f317","observation_id":"54f4af7d-478a-4730-a630-eaa271f23cca","resolution":{"observed_at":"2026-08-07T15:42:32.247738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:32.402656Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:32.402656Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:bac513335c35d9718e235bdb50fa5ccbda3010caccd81eaabb7334fb1db7ec5b","observation_id":"f98c7e8c-78dd-4f6e-a4ea-985c269fd065","resolution":{"observed_at":"2026-08-07T15:42:32.402656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-07T15:42:32.513753Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:32.513753Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:0c220f0cc3c3703af6426a118069982370cd1709708549c054328eb1519df737","observation_id":"4a3cf486-9d7b-4c94-a396-953cb1cb176d","resolution":{"observed_at":"2026-08-07T15:42:32.513753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11196","last_updated":"2025-06-01T08:43:20Z","snapshot_observed_at":"2026-08-07T18:14:32.541842Z","submitted_at":"2025-02-16T16:55:43Z","title":"How Do LLMs Acquire New Knowledge? A Knowledge Circuits Perspective on Continual Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11196","snapshot_observed_at":"2026-08-07T15:42:32.659490Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:32.659490Z"},"links":{"cited_paper":"/paper/2502.11196","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:05be828c70594fd6814ec64f9eb8e8fa94e8b1a3116b852a9cbb2aeac802de9a","observation_id":"1ae10703-9ec0-4440-9443-add8c5e5a0a6","resolution":{"observed_at":"2026-08-07T15:42:32.659490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:32.737455Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:32.737455Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:e5a12f6379c01d70aa9201d48be514b0d7055b760c979ef7e5d621f6200947d1","observation_id":"b2873002-6487-4545-88ad-cfda3ac77a59","resolution":{"observed_at":"2026-08-07T15:42:32.737455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09674","last_updated":"2025-05-27T08:40:42Z","snapshot_observed_at":"2026-08-09T02:24:15.276351Z","submitted_at":"2025-02-13T06:39:22Z","title":"The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09674","snapshot_observed_at":"2026-08-07T15:42:32.812422Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:32.812422Z"},"links":{"cited_paper":"/paper/2502.09674","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:cfd49e402123d03096c50bef96ab216ffb78fb23b6c1c369263acb76b2cb037b","observation_id":"63ed797c-92c4-44b6-b78d-d3a1b93a6163","resolution":{"observed_at":"2026-08-07T15:42:32.812422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.05906","last_updated":"2021-08-02T19:03:40Z","snapshot_observed_at":"2026-08-10T02:41:13.375348Z","submitted_at":"2020-10-12T17:58:43Z","title":"Back to the Future: Unsupervised Backprop-based Decoding for Counterfactual and Abductive Commonsense Reasoning","version":4},"cited_work":{"arxiv_id":"2010.05906","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.05906","snapshot_observed_at":"2026-08-07T15:42:35.511673Z","title":"Back to the Future: Unsupervised Backprop-based Decoding for Counterfactual and Abductive Commonsense Reasoning","venue":"cs.CL","work_id":"1604e581-c788-45df-8727-28e8c384288a","year":2020},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:32.887910Z"},"links":{"cited_paper":"/paper/2010.05906","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:40ee334bb23fb8b12ba41365602e8d427ea1e324c0b624c20cd4120b792abe2d","observation_id":"c4775586-43ab-4b75-9ed7-cd07cb1fb1b1","resolution":{"observed_at":"2026-08-07T15:42:35.595656Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:32.984503Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:32.984503Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:a53aea2d10b9f14a025159c3b832c5d26952b3e7546ec550669de861c11f1460","observation_id":"f3e95b49-3a12-42ec-8797-3fac0f195282","resolution":{"observed_at":"2026-08-07T15:42:32.984503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.052940Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.052940Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:cd339dd20ba6b1016a0385843eee10516137868e90cecbb04f5e5df2ea953bac","observation_id":"1c257683-16cb-48fb-a62b-a6baca8c13bb","resolution":{"observed_at":"2026-08-07T15:42:33.052940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12824","last_updated":"2024-07-02T12:48:29Z","snapshot_observed_at":"2026-08-03T08:12:12.355461Z","submitted_at":"2024-07-02T12:48:29Z","title":"Whispering Experts: Neural Interventions for Toxicity Mitigation in Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12824","snapshot_observed_at":"2026-08-07T15:42:33.134548Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.134548Z"},"links":{"cited_paper":"/paper/2407.12824","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:f4c73857a0ed4408621cafa70d30a11a8e79e9c96b4b7f865dcca619d4443a00","observation_id":"3747225d-75ba-47bf-a7c0-81c2fbf4c196","resolution":{"observed_at":"2026-08-07T15:42:33.134548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.226307Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.226307Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:28bfdab309fe9602faa5a7b3afad411592865af4600c809f33a8c4c5d34e416e","observation_id":"aafb8c31-4fb1-4b82-9d73-b1ad8801d2ee","resolution":{"observed_at":"2026-08-07T15:42:33.226307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15213","last_updated":"2024-02-25T18:32:18Z","snapshot_observed_at":"2026-08-08T01:23:24.701475Z","submitted_at":"2023-10-23T17:55:24Z","title":"Function Vectors in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15213","snapshot_observed_at":"2026-08-07T15:42:33.313206Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.313206Z"},"links":{"cited_paper":"/paper/2310.15213","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:273768a2181025b7790506e08e3b40879727411a865ed5f4a9b5f6f0ca748d75","observation_id":"d7a229c4-804a-43cd-ac26-2a4f81e96d8d","resolution":{"observed_at":"2026-08-07T15:42:33.313206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:36.299558Z","title":null,"venue":null,"work_id":"9edb19a1-f0ff-4c91-8444-2c7265cd4722","year":2025},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.391718Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:5ddebc0becef8cdea8978099aa6b5cb261a605e0c64b3f59fddd3e6d62ae902d","observation_id":"a342c3a4-e89b-4bca-86f7-afb188ca2318","resolution":{"observed_at":"2026-08-07T15:42:36.407052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.486225Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.486225Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:cb6852d5ddcc8cf6edf9aa0ed90159941419a0763793c605f9e721db98bb2c43","observation_id":"bee9739f-8e95-4919-842f-7b17a6f03b7d","resolution":{"observed_at":"2026-08-07T15:42:33.486225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.593951Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.593951Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:b7355ce69e9392cf4fd0f8b8dadeef2b773eff4733da933d48649f254e2d3216","observation_id":"572592ee-afe2-490c-9246-afbd008ec68e","resolution":{"observed_at":"2026-08-07T15:42:33.593951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.684125Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.684125Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:b5513d08319b956bfb0562edad074f06883a528d52ab415b87c1fcf2d135bab4","observation_id":"caf42a89-8f96-4b7a-b82b-b4f12b28c000","resolution":{"observed_at":"2026-08-07T15:42:33.684125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04990","last_updated":"2025-02-19T06:51:44Z","snapshot_observed_at":"2026-07-06T17:56:49.318298Z","submitted_at":"2024-04-07T15:23:28Z","title":"MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models","version":3},"cited_work":{"arxiv_id":"2404.04990","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.04990","snapshot_observed_at":"2026-08-07T15:42:35.241622Z","title":"MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models","venue":"cs.CL","work_id":"b4c67bbb-9501-47ec-a236-264567e2aa66","year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.775749Z"},"links":{"cited_paper":"/paper/2404.04990","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:77a2ef34298fd19383d3609885a92d073d91c940f2b8614a9c0bd2fd66cb0014","observation_id":"e8d5339d-76e1-47eb-8184-3b2997e1852f","resolution":{"observed_at":"2026-08-07T15:42:35.368512Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08152","last_updated":"2024-08-15T13:40:03Z","snapshot_observed_at":"2026-07-06T19:01:06.124684Z","submitted_at":"2024-08-15T13:40:03Z","title":"DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08152","snapshot_observed_at":"2026-08-07T15:42:33.854739Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.854739Z"},"links":{"cited_paper":"/paper/2408.08152","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:349e48dc481e72c99a0621719aa659467c7f4950bda68c006004ffa9d8924acf","observation_id":"fa8798e2-dfe8-4a2a-948a-3063f9ce1879","resolution":{"observed_at":"2026-08-07T15:42:33.854739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08983","last_updated":"2024-07-25T22:59:44Z","snapshot_observed_at":"2026-08-06T04:06:56.137869Z","submitted_at":"2024-02-14T06:54:31Z","title":"SafeDecoding: Defending against Jailbreak Attacks via Safety-Aware Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08983","snapshot_observed_at":"2026-08-07T15:42:33.939169Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:33.939169Z"},"links":{"cited_paper":"/paper/2402.08983","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:3464168775e1397ec3c494e1a1ccfccc91219fb6afe27213b7d235b85ac71839","observation_id":"81774b8d-8151-4458-9f5b-abf3727b8984","resolution":{"observed_at":"2026-08-07T15:42:33.939169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:34.038431Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.038431Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:fe597ab2984db5ab7c4fd8728506466bbaf0a5fdc6cfd25c3ba1ff2018487ea9","observation_id":"63c3cdbe-a1e5-456d-85ec-57ac075670c2","resolution":{"observed_at":"2026-08-07T15:42:34.038431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09656","last_updated":"2024-06-05T09:43:00Z","snapshot_observed_at":"2026-08-08T09:00:15.460860Z","submitted_at":"2024-02-15T01:50:38Z","title":"The Butterfly Effect of Model Editing: Few Edits Can Trigger Large Language Models Collapse","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09656","snapshot_observed_at":"2026-08-07T15:42:34.123986Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.123986Z"},"links":{"cited_paper":"/paper/2402.09656","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:bf9c11248fcd0123217763b22f88ec0c00f23e2b57d68d7ef187fe51e8503454","observation_id":"ba919713-722f-441b-acca-c035a371369a","resolution":{"observed_at":"2026-08-07T15:42:34.123986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17969","last_updated":"2025-01-03T16:41:37Z","snapshot_observed_at":"2026-08-08T01:27:33.186418Z","submitted_at":"2024-05-28T08:56:33Z","title":"Knowledge Circuits in Pretrained Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17969","snapshot_observed_at":"2026-08-07T15:42:34.207035Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.207035Z"},"links":{"cited_paper":"/paper/2405.17969","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:d62e90f1a0ad97bab0f1cafd543b6f196bb1c3027f770eea0340bca5f6888b04","observation_id":"b50eff71-d362-4bc0-b505-bbc2919538a1","resolution":{"observed_at":"2026-08-07T15:42:34.207035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12141","last_updated":"2024-09-24T20:36:03Z","snapshot_observed_at":"2026-08-09T00:57:23.087960Z","submitted_at":"2023-12-19T13:23:18Z","title":"Neuron-Level Knowledge Attribution in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12141","snapshot_observed_at":"2026-08-07T15:42:34.283123Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.283123Z"},"links":{"cited_paper":"/paper/2312.12141","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:f14d1f988cc1ee1553653e9cf4f50b0ca95c14b5d8c2c6a352668280afbd5808","observation_id":"5729fcf9-b6b0-4e6a-a4f9-8a32358e31cc","resolution":{"observed_at":"2026-08-07T15:42:34.283123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-07T15:42:34.376831Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.376831Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:e4d09a5d52ef56bcd7cc9e959bf82cab003ddacacc2ca1705f234c5f9d02185e","observation_id":"f7e0fd40-5c49-4eb0-b8eb-6d417cdea73a","resolution":{"observed_at":"2026-08-07T15:42:34.376831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:36.056459Z","title":null,"venue":null,"work_id":"c24fec4c-a41e-490f-8f3c-7047c886c248","year":2023},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.478018Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:e51717ebbfbe5623a81d080ac3eec36b42888d2458b3d46a0d33206ae221cb58","observation_id":"f16bf62d-dd4e-4c87-83db-b92a1db5c31e","resolution":{"observed_at":"2026-08-07T15:42:36.146355Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18166","last_updated":"2024-06-14T07:27:26Z","snapshot_observed_at":"2026-08-09T23:55:57.827623Z","submitted_at":"2024-05-28T13:26:12Z","title":"Defending Large Language Models Against Jailbreak Attacks via Layer-specific Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18166","snapshot_observed_at":"2026-08-07T15:42:34.599908Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.599908Z"},"links":{"cited_paper":"/paper/2405.18166","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:7c276cd7affe23ed35158b44f08f5272e5970bb7a371f9ceec733a751ba46bde","observation_id":"011b081c-b633-4b13-b08b-47f08cc71277","resolution":{"observed_at":"2026-08-07T15:42:34.599908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15140","last_updated":"2023-12-14T06:22:51Z","snapshot_observed_at":"2026-08-03T19:47:58.067345Z","submitted_at":"2023-10-23T17:46:07Z","title":"AutoDAN: Interpretable Gradient-Based Adversarial Attacks on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15140","snapshot_observed_at":"2026-08-07T15:42:34.703077Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.703077Z"},"links":{"cited_paper":"/paper/2310.15140","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:4157e350b24746204bd55915001e421db560b2195660a094bbf061dd03b4e9d8","observation_id":"02a16147-cfe0-4bce-ad0c-128ffa0dddcf","resolution":{"observed_at":"2026-08-07T15:42:34.703077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T15:42:34.774738Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.774738Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:2c339a0758b4a74212b153b027366f637e9384e5e0dd0bd0f6a71ad044e1ab65","observation_id":"28e6be3c-d059-43de-8e0a-485b1903f590","resolution":{"observed_at":"2026-08-07T15:42:34.774738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:34.854093Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.854093Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:25a7cb4407aea490fc90e282fed32ddd1850a424dcaeddffc84166a2de497c7f","observation_id":"ce3fa351-96ba-4940-b9f5-f6866efe69fb","resolution":{"observed_at":"2026-08-07T15:42:34.854093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:34.927348Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:34.927348Z"},"links":{"citing_paper":"/paper/2505.17078"},"observation_digest":"sha256:72a54acc06b3351fd0aa53551d50cd3907ab6e65b1fb3dbe54aa8d97f2d3c598","observation_id":"deca8457-878a-47e1-abdf-38d30f342aab","resolution":{"observed_at":"2026-08-07T15:42:34.927348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17078","last_updated":"2025-05-20T08:29:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T00:35:20.013849Z","submitted_at":"2025-05-20T08:29:11Z","title":"GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 1 inbound Pith citation observation for arXiv:2505.17078."}