{"as_of":"2026-08-10T20:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c756fe47d003baf9308b95175539be16db2a78a4d7b18d439eaa350b2c832e6f","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T10:40:48.791843Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T04:55:34.529357Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T04:56:38.824910Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"cited_work":{"arxiv_id":"2602.02498","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.02498","snapshot_observed_at":"2026-06-30T02:16:14.044451Z","title":"Test-time detoxification without training or learning anything","venue":null,"work_id":"fcfc4400-5bb6-44f7-a941-018e217f37b1","year":2026},"citing_paper":{"arxiv_id":"2605.23180","last_updated":"2026-05-22T03:01:34Z","snapshot_observed_at":"2026-07-06T23:33:24.215365Z","submitted_at":"2026-05-22T03:01:34Z","title":"Self-Improving In-Context Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-25T04:55:34.529357Z"},"links":{"cited_paper":"/paper/2602.02498","citing_paper":"/paper/2605.23180"},"observation_digest":"sha256:d4ff4d14d7398ea139907ea7dbbfa3e91207c21fa04c5960d44ad958be739e54","observation_id":"4ef9a461-ef0a-4c98-845a-2a15d2b6f4fe","resolution":{"observed_at":"2026-06-30T02:16:14.044451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.02498/citation-record","integrity":"/paper/2602.02498/integrity","json":"/paper/2602.02498/citation-record.json","paper":"/paper/2602.02498"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:42.806327Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:42.806327Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:3bc5bc7d1756ed96d227d2e36fd736bc6bd45720e3d8f6a94ad83a589e1c8822","observation_id":"5fbec80c-406f-45c5-8abe-ebf68d20837b","resolution":{"observed_at":"2026-08-03T10:40:42.806327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:42.906428Z","title":"Director: Generator-classifiers for supervised language modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:42.906428Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:8ac128461b9628cd5373ba210a7a7f33bf7ff33c5f8f7abf911e94187223a9e4","observation_id":"c28332af-9338-440b-89fb-b20c1817cd09","resolution":{"observed_at":"2026-08-03T10:40:42.906428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:43.138049Z","title":"Systematic rectification of language models via dead-end analysis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:43.138049Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:ae4d50e77c9b9122d516dc0f131a1ff7adeeb09de511e5fa5d78c3130f736cbc","observation_id":"eeb2f311-d67a-4273-a35a-c0e940209cf1","resolution":{"observed_at":"2026-08-03T10:40:43.138049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:43.238194Z","title":"Enhancing zeroth-order fine- tuning for language models with low-rank structures","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:43.238194Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:2cd6b8ae3437affa91d22fbdd1507870b36e7584dc960799871ac1dd612f1ee8","observation_id":"82d694e5-1eec-47ff-9527-f509d12f15c6","resolution":{"observed_at":"2026-08-03T10:40:43.238194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:43.498895Z","title":"Plug and play language models: A simple approach to controlled text generation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:43.498895Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:b5a87aba0d95a139890eb4f7ddbf402707d5f3f75ac5d56a575427325733e533","observation_id":"f6e96ec4-ced7-4fe6-971a-43c9d65c1c71","resolution":{"observed_at":"2026-08-03T10:40:43.498895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:43.632600Z","title":"Reward-augmented decoding: Efficient controlled text generation with a unidirectional reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:43.632600Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:6ddc6954d553729d21324a5473be5bbb18010d50d3cf5287cbf2676d8dcc01b7","observation_id":"cd67719c-dd48-46c0-9c99-8017865f3d2b","resolution":{"observed_at":"2026-08-03T10:40:43.632600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:43.705903Z","title":"Bold: Dataset and metrics for measuring biases in open-ended language generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:43.705903Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:6345b5556318a609d65bb0e8d8902e1aae5763cf942cccb4e14e007417108d81","observation_id":"502b7096-03f6-4cd4-a7d2-45c6438fa9b8","resolution":{"observed_at":"2026-08-03T10:40:43.705903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:43.810434Z","title":"DSCD: Large lan- guage model detoxification with self-constrained decoding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:43.810434Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:9f7ac42489e995e41d94f771f5c0754feb301db20e880a7f25d33c08994836de","observation_id":"38cc1a41-5dae-4ff5-946a-059a6481c78e","resolution":{"observed_at":"2026-08-03T10:40:43.810434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:43.896219Z","title":"Variance- reduced zeroth-order methods for fine-tuning language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:43.896219Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:222a08542383f883865fa999919c2876a9e0275c29e895a07ada2b6f82747bb4","observation_id":"d7a17d23-64c3-49a0-a178-c7900e578e85","resolution":{"observed_at":"2026-08-03T10:40:43.896219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:43.943014Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:43.943014Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:c3df145a8db8609bbc19a8750e4402eb8b07af10063e60956e6e32f5de574c1b","observation_id":"5d51cb23-83d6-4276-9097-909f18453f2b","resolution":{"observed_at":"2026-08-03T10:40:43.943014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.004827Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.004827Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:8635b81d2998f2a9cf478e085ff2a125e553ffad53a7c95a4ac77e0303520db1","observation_id":"157e485f-4594-47b7-b2d2-a0ad8553583e","resolution":{"observed_at":"2026-08-03T10:40:44.004827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.121222Z","title":"Word embeddings are steers for language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.121222Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:ed597e7b2235e0ab961ff2509a9224564a7792c763ca2ed34589349b7e09282a","observation_id":"579e2b8e-6328-4685-a7f4-fb1084a74cba","resolution":{"observed_at":"2026-08-03T10:40:44.121222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.209549Z","title":"Detoxify","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.209549Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:8b0f90b08173d479b2517e0725c119af57373fcfbb74df7686c3f1809cb36cb7","observation_id":"ae82e7b5-6a7e-458a-af24-06451250ab3b","resolution":{"observed_at":"2026-08-03T10:40:44.209549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.273656Z","title":"Model-free learning of two-stage beamformers for passive irs-aided network design.IEEE Transactions on Signal Processing, 72:652–669,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.273656Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:0d2cc73b35b46de6ceaf1fdb9824339f0f4d74e762cb21980d0d9cc72f3cd648","observation_id":"2c83bf68-9162-4578-a80f-6f67eecf91f2","resolution":{"observed_at":"2026-08-03T10:40:44.273656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.504047Z","title":"Localized zeroth-order prompt optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.504047Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:6b8857a8794f97ec7215a3cd75ccd915dfe65d6cfc2d14ad8038bbdf3dbd246b","observation_id":"084e3342-62b1-4270-8b5f-d95c109b1374","resolution":{"observed_at":"2026-08-03T10:40:44.504047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.779","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPI: Domain adaptive toxicity probe vector intervention, for fine-grained detoxification","venue":null,"work_id":"e2ac9822-e702-4fda-bacb-cc95b9a18d49","year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.629329Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:670ed9452250c2d2b87a0b97ca101779a1d43bec94a5d2c615f034d69b6f5911","observation_id":"f0729dc6-e052-41f2-9071-10a9d4987397","resolution":{"observed_at":"2026-08-03T10:43:24.692646Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.720686Z","title":"Perspective API","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.720686Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:e798872ab9e2873b84ea355d4ec48374eab38b9b0d98c69efe0a8e984c253b71","observation_id":"7a283070-9e23-43dd-8b09-b98104127966","resolution":{"observed_at":"2026-08-03T10:40:44.720686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.795718Z","title":"Critic- guided decoding for controlled text generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.795718Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:40407c50c16bb22c9a0c505625058213808a85c178e8f4a043b7655b20561d35","observation_id":"64ae9e1a-f551-42df-af01-c3b013650296","resolution":{"observed_at":"2026-08-03T10:40:44.795718Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.873491Z","title":"Large language models can become strong self- detoxifiers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.873491Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:fa119d27bcf2f11ce1f4734a85e71f4e0aa0f3945de77318bc0f399528928ffe","observation_id":"1f5dc989-3cd5-4410-b345-4148f91f3df4","resolution":{"observed_at":"2026-08-03T10:40:44.873491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.964749Z","title":"Unveiling safety vulnerabilities of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.964749Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:a6fe076595a72203731a9daa26b1761476b701add69ea60d11b2439d1b9d03dd","observation_id":"955af843-20b7-4da8-be3a-be83c641809f","resolution":{"observed_at":"2026-08-03T10:40:44.964749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:45.034797Z","title":"GeDi: Generative discriminator guided sequence generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.034797Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:8997a1ef408aa5d2c8268175cae33825a6a8a967da29437ccc2a1f0c384f5931","observation_id":"216f01e5-d833-448e-8418-0bbfaa8a4875","resolution":{"observed_at":"2026-08-03T10:40:45.034797Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-long.565","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language detoxification with attribute- discriminative latent space","venue":null,"work_id":"d1383b01-084e-46ff-8a42-f702cc82947d","year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.164770Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:62515ddedb0733e6abf60b2f4a4e8764b6e5192a02d3ef8cf1c2314487ea37ac","observation_id":"605f244e-891a-47da-90f4-c4ce37916eee","resolution":{"observed_at":"2026-08-03T10:43:24.522898Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:45.281879Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.281879Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:a1509c58273e7852243bf51350ff9fc0cbee6872ff763af32e195af9c91ea250","observation_id":"b64555ad-df0f-49e1-b4c4-41dd3838165e","resolution":{"observed_at":"2026-08-03T10:40:45.281879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.269","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-detoxifying language models via toxification reversal","venue":null,"work_id":"621a8bab-a02c-45c8-90fc-2cd0b59b2cfa","year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.374977Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:eca3d98571c02345ffb5d89501e2b7230d02139508650003fe218d11fb999c4a","observation_id":"03923ffc-0057-44f5-818f-6a76c4982658","resolution":{"observed_at":"2026-08-03T10:43:24.384596Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:45.485812Z","title":"Destein: Navigating detoxification of language models via universal steering pairs and head-wise activation fusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.485812Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:435c75b86bb19d4da97af6490b9dd9ceb97609e9280af8ab918b3fff7f546bc9","observation_id":"0b6fe4ba-a631-48d5-bb9b-a5a7da976b39","resolution":{"observed_at":"2026-08-03T10:40:45.485812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:45.652959Z","title":"Smith, and Yejin Choi","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.652959Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:1c5a18619e5bf007c90fe4d145ff4252ebaebfaeabc6d74c80347befcfd0a069","observation_id":"f8f252cd-af32-4401-a721-52cd7ffecaaf","resolution":{"observed_at":"2026-08-03T10:40:45.652959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:45.693911Z","title":"Sparse meZO: Less parameters for better performance in zeroth-order LLM fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.693911Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:85e210600d3e1086f3ae82298fdc0371def415b14c26752ddb508e6aa72bd819","observation_id":"bd5990ec-16a9-4d5c-a7ae-baa7eb3ebede","resolution":{"observed_at":"2026-08-03T10:40:45.693911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:45.743033Z","title":"Unidetox: Universal detoxification of large language models via dataset distillation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.743033Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:b229f141a389a7bd3cc5c99c46e641c84bd9248ea35c37763438546d5a99726e","observation_id":"bb77aae4-d392-4731-84e4-66f8aacb8cb4","resolution":{"observed_at":"2026-08-03T10:40:45.743033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:45.851721Z","title":"Quark: controllable text generation with reinforced [un]learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.851721Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:b474b0f5acdf2b183cf977d581ebd3853f25452a8def686c974ffb30c87e227f","observation_id":"f767a2fb-0b8d-4c35-a484-3ae8ee2cd770","resolution":{"observed_at":"2026-08-03T10:40:45.851721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:45.887597Z","title":"Lee, Danqi Chen, and Sanjeev Arora","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.887597Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:84cba55b74882d686df638d0df48ee9036a36dc14eff44348e9326d8a3db2e0b","observation_id":"b19ddedc-2011-4def-a7ff-80975d070efa","resolution":{"observed_at":"2026-08-03T10:40:45.887597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.779","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attribute controlled fine-tuning for large language models: A case study on detoxification","venue":null,"work_id":"633e3a1c-8683-45cf-8e99-50d76a0a482b","year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:45.964587Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:63ebd86865cdb606b69d89ce75bd8d0e34d28ca5dedc6f4975dcce03b472befe","observation_id":"18635821-dc52-44cf-91a3-a9e391d55e05","resolution":{"observed_at":"2026-08-03T10:43:24.244761Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:46.020125Z","title":"Random gradient-free minimization of convex functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.020125Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:11329fd5b847ecfc56d4f33673ffc57fc5f21b91ae588a4028abb449aca03c90","observation_id":"d0402cb6-c075-4fd6-b094-65439c0de751","resolution":{"observed_at":"2026-08-03T10:40:46.020125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.hucllm-1.3","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Parameter-efficient detoxification with contrastive decoding","venue":null,"work_id":"699db6f7-ef16-4cb3-9e9d-6752f2e139e7","year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.058184Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:6894c145308462c4669b187c95874b6fa9d4936a139aa603909a5fef50d99d8e","observation_id":"1ddaa856-8604-4f4a-9c8f-448347729a39","resolution":{"observed_at":"2026-08-03T10:43:24.076472Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:46.191848Z","title":"Best practices for prompt engineering with the openai api","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.191848Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:0907e1af966bf4da4bf6367622d3b8f208d86005892162dd8f3c41cb675d8019","observation_id":"f91f805c-fd2f-4e6e-968d-695a278c72ad","resolution":{"observed_at":"2026-08-03T10:40:46.191848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:46.307849Z","title":"Training language models to follow instructions with human feed- back","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.307849Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:6cdf344c1283d566731d86121fd5c3b65b6cbb2ba0ba69d4bf245e7088a00e34","observation_id":"8387a427-3026-4492-953a-d608a990e76b","resolution":{"observed_at":"2026-08-03T10:40:46.307849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:46.421898Z","title":"Data-driven learning of two-stage beamformers in passive irs-assisted systems with inexact oracles.IEEE Access, 13:154984–155002, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.421898Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:5cf54b45315f44480105374d13d0bc84f7bdc4024ecc4cd1c82a522dd849e065","observation_id":"005b707d-c3a5-4a33-a28c-d496456cc20a","resolution":{"observed_at":"2026-08-03T10:40:46.421898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:46.579704Z","title":"On the challenges of using black-box APIs for toxicity evaluation in research","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.579704Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:1bb44fd584c59faa3aab6ddb575ae7b16ed14b9ed75bdec347acdafc9fb0647e","observation_id":"611a6e23-6b04-4b48-bae3-f7ad91613cc7","resolution":{"observed_at":"2026-08-03T10:40:46.579704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:46.741625Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.741625Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:8626ef8ac73cc11d15b5a4950a398386c6905c49a757d27fc724e7bfc92384c8","observation_id":"40f6cee7-372e-4440-9cea-f43ca655ad48","resolution":{"observed_at":"2026-08-03T10:40:46.741625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01477","last_updated":"2025-02-08T01:06:29Z","snapshot_observed_at":"2026-08-05T23:14:37.200098Z","submitted_at":"2024-09-02T22:00:50Z","title":"Compatible Gradient Approximations for Actor-Critic Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01477","snapshot_observed_at":"2026-08-03T10:40:46.798099Z","title":"Compatible gradient approximations for actor-critic algo- rithms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.798099Z"},"links":{"cited_paper":"/paper/2409.01477","citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:4dcf969890a3560eb0163f4d1ac5fe630305dfbd1400d142561930f3f992ed2e","observation_id":"c12e80fd-9820-4537-b43a-468bc9c0e001","resolution":{"observed_at":"2026-08-03T10:40:46.798099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:46.850563Z","title":"Self-diagnosis and self-debiasing: A proposal for reducing corpus-based bias in nlp.Transactions of the Association for Computational Linguistics, 9: 1408–1424, 12 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.850563Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:f1f5678b0da4f66774a0cad5182824cfb8bac1d9ed772fdf9b7e26e632d2451f","observation_id":"9b4258fc-5a6a-4a57-8ae7-aee8bceed33b","resolution":{"observed_at":"2026-08-03T10:40:46.850563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-03T10:40:46.882802Z","title":"Gemma 2: Improving open language models at a practical size, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:46.882802Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:749150e25eb3a95ebbe1bb98aa5c87ecd72dbf4ff6edf67d57109e4ee1d230e9","observation_id":"d7a9f0f6-951a-4c6c-a1f9-cf09c97b08c6","resolution":{"observed_at":"2026-08-03T10:40:46.882802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:47.108176Z","title":"Supporting Human Raters with the Detection of Harmful Content Using Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:47.108176Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:05721d38c9fc72e5a563c0ccdb826e435d8f33319d26765de7abf6abe9b7379f","observation_id":"7db505d2-cf81-445a-96a0-51a605765a09","resolution":{"observed_at":"2026-08-03T10:40:47.108176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:47.258215Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:47.258215Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:6a5ced0af6d19173689f2b60fefa71d8d6767886a3dd67a549a8974e853eb08c","observation_id":"d0fda032-79be-4c75-9c97-1bdff3970190","resolution":{"observed_at":"2026-08-03T10:40:47.258215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:47.413277Z","title":"Exploring the limits of domain-adaptive training for detoxifying large-scale language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:47.413277Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:3d08d169a7ab2e597da249561cfede7c2b375a4b932c2e8331fca6e614527184","observation_id":"d6608bb6-3a5a-4bf5-8d19-502254983ebc","resolution":{"observed_at":"2026-08-03T10:40:47.413277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.01059","last_updated":"2025-08-01T20:25:57Z","snapshot_observed_at":"2026-08-09T20:48:33.918675Z","submitted_at":"2025-08-01T20:25:57Z","title":"Llama-3.1-FoundationAI-SecurityLLM-8B-Instruct Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.01059","snapshot_observed_at":"2026-08-03T10:40:47.652225Z","title":"Llama-3.1-foundationai-securityllm-8b- instruct technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:47.652225Z"},"links":{"cited_paper":"/paper/2508.01059","citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:78f89b3d6dff7c341cf53110e875b20f5e3d6e128bdb567904017e169eaa3764","observation_id":"068f988c-52e5-4efc-9fdc-96c9f8aefab7","resolution":{"observed_at":"2026-08-03T10:40:47.652225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.fi","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:43:23.872737Z","title":"Challenges in detoxifying language models","venue":null,"work_id":"19ce1f5d-c090-4e1f-915f-a732f0829fa2","year":2021},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:47.814230Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:2fe3d0c1ea4452ac7c27e40d17f66995d2b997e9905ddf2f8d31d289dc1b7e62","observation_id":"5a1f4783-4ead-4eb8-9fa3-2ddf13ed13a2","resolution":{"observed_at":"2026-08-03T10:43:23.959123Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:47.969024Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:47.969024Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:2deac7de6080769f93ce425c0b30e445f82cadef6db640c329fd2d5c0d52c585","observation_id":"ea4d298d-36ed-452f-a225-8b5ed21fe92d","resolution":{"observed_at":"2026-08-03T10:40:47.969024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.07079","last_updated":"2021-08-04T21:33:39Z","snapshot_observed_at":"2026-08-06T19:00:21.027890Z","submitted_at":"2020-10-14T13:26:39Z","title":"Recipes for Safety in Open-domain Chatbots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.07079","snapshot_observed_at":"2026-08-03T10:40:48.133852Z","title":"Recipes for safety in open-domain chatbots, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:48.133852Z"},"links":{"cited_paper":"/paper/2010.07079","citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:2a29e6e8b11e35d278e9fe2c1a66c522b11269692012d09b1c85678c32e1c541","observation_id":"b30a5345-9c90-4959-a990-ed83e702c121","resolution":{"observed_at":"2026-08-03T10:40:48.133852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:48.239022Z","title":"SafeDecoding: Defending against jailbreak attacks via safety-aware decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:48.239022Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:bc98239f4a94ee67b7f895222bc95153d1f55239805a3835b78440d6a07420e7","observation_id":"06bb1a45-8d5d-4ac7-85b0-c841b522d2e5","resolution":{"observed_at":"2026-08-03T10:40:48.239022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T10:40:48.406588Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:48.406588Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:8c9da6c48f584cbcde3d1bd71736b131fea63118b1079b1e0b11fdf039233126","observation_id":"f86dc234-3023-4839-8f86-4b978e448fd0","resolution":{"observed_at":"2026-08-03T10:40:48.406588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:48.360785Z","title":"doi: 10.18653/v1/2024.acl-long.303","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:48.360785Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:4853ee9ccf85e5ac19c095cc1923920feee89f49682fa6f852cfb522ca88c667","observation_id":"836aad66-9385-4267-ab9a-c0498fe189bf","resolution":{"observed_at":"2026-08-03T10:40:48.360785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:48.581549Z","title":"Unlocking black-box prompt tuning efficiency via zeroth-order optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:48.581549Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:98db130fb2e011c151450330190f51862c1cd6ac8c1797f5dae00db4a5403a82","observation_id":"2f576f16-a0d8-4fca-8992-9dfa7bcc1f9d","resolution":{"observed_at":"2026-08-03T10:40:48.581549Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.na","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:43:23.769377Z","title":"FUDGE: Controlled text generation with future discriminators","venue":null,"work_id":"94397a5e-879b-42b8-9f23-6ccd8b85c300","year":2021},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:48.508273Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:8b21f5a7c6c4c2aeb5f2b9dd5816000d951085040b813d02dbe99d33a386c9a6","observation_id":"47e91581-2346-4096-90cc-4fe25c9bcce4","resolution":{"observed_at":"2026-08-03T10:43:23.852656Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:48.791843Z","title":"challenging","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:48.791843Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:0ee8896d12b50db5e0a73b53b0c9eafbce854987efc61475239f91de5660df83","observation_id":"3e9072a0-91cb-4d51-8f1b-19ca041561a0","resolution":{"observed_at":"2026-08-03T10:40:48.791843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.298","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Detoxifying large language models via the diversity of toxic samples","venue":null,"work_id":"bf31a396-45d1-4045-bea3-d169b2e4b2ec","year":2025},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:48.682146Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:b967ea3ded6ee921c7033c7431d25c8518ba0145d3cbf0fa31137bf88e940737","observation_id":"34348249-bd37-40b0-8a86-671f35d610f6","resolution":{"observed_at":"2026-08-03T10:43:23.746647Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:40:44.411215Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T10:40:44.411215Z"},"links":{"citing_paper":"/paper/2602.02498"},"observation_digest":"sha256:52afefda4b8ed64e221916164f122c134490b2cb9b6e07dafc47e02e0667149a","observation_id":"7ef13665-fc61-4fb2-9cff-e194a52b1c7f","resolution":{"observed_at":"2026-08-03T10:40:44.411215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.02498","last_updated":"2026-06-28T14:45:33Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T20:48:51.806563Z","submitted_at":"2026-01-14T11:54:23Z","title":"Test-Time Detoxification without Training or Learning Anything"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 1 inbound Pith citation observation for arXiv:2602.02498."}