{"as_of":"2026-08-10T09:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:05aef5bf0233deb94295184674657b5a879f207d28a33c77b76f361b136ca137","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:51:54.491362Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01266/citation-record","integrity":"/paper/2506.01266/integrity","json":"/paper/2506.01266/citation-record.json","paper":"/paper/2506.01266"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:45.272478Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.272478Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:daab318d560ee0cc12c9f731f73aab628fabafae40bbcd55db55299d7c6f6172","observation_id":"b89bdda8-fa52-4c7e-af61-2f38f5c89343","resolution":{"observed_at":"2026-08-07T11:51:45.272478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:45.304035Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.304035Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:7233b460cd6ca28cdf15dbab3363fcc48c69e0e04f900615247642dfeb82a195","observation_id":"20acb898-7531-4fc2-bb9f-dc0e2bf351a9","resolution":{"observed_at":"2026-08-07T11:51:45.304035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:51:45.333566Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.333566Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:799cfe2395c60eb520b54896e1587a684eeeb3a2b281499d3970cb3ee83417d9","observation_id":"6be7d929-abbe-4758-b969-a3675539e5bb","resolution":{"observed_at":"2026-08-07T11:51:45.333566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:04.022072Z","title":null,"venue":null,"work_id":"2923c70d-652a-443f-90ae-0ef87ddf13e2","year":2020},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.364356Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:266913b5a1f05d9be1d7f7a572fd7bcdf22f79e961d15aadae38a6a503ebf7b4","observation_id":"b6863612-2737-4174-b008-bd3b3d3ee3ed","resolution":{"observed_at":"2026-08-07T11:52:04.142692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:45.395877Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.395877Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:fab75f7bc60a2eced492f90eba2e78689b0df833641837f514c34c8a063cd1f2","observation_id":"a679713c-07ea-4dca-972a-26e73c51849d","resolution":{"observed_at":"2026-08-07T11:51:45.395877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03301","last_updated":"2024-04-04T17:41:12Z","snapshot_observed_at":"2026-08-09T19:27:43.315387Z","submitted_at":"2023-11-06T17:49:34Z","title":"Ziya2: Data-centric Learning is All LLMs Need","version":2},"cited_work":{"arxiv_id":"2311.03301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.03301","snapshot_observed_at":"2026-08-07T11:51:56.527748Z","title":"Ziya2: Data-centric Learning is All LLMs Need","venue":"cs.CL","work_id":"c2d086d1-b12d-45cd-84da-32eceeff0af2","year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.426914Z"},"links":{"cited_paper":"/paper/2311.03301","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:8c482746fb46e781390a301550a2a5a7b02a60b067ae724ebcee9e58f0293588","observation_id":"40eaaf01-ab00-4cdf-9bf9-0a05778f6242","resolution":{"observed_at":"2026-08-07T11:51:56.715361Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.801370Z","title":null,"venue":null,"work_id":"5c5a54aa-e325-42f3-9ddc-229c6c3ffc91","year":2020},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.461546Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:8d90a87fb261f4e6b2f13a3401ec83bf3a8af981ccbd2ea70b495e40966e4467","observation_id":"36a2baf0-7e55-4bb9-b8bb-0e73a5aa1061","resolution":{"observed_at":"2026-08-07T11:52:03.906447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14680","last_updated":"2022-10-12T18:01:23Z","snapshot_observed_at":"2026-08-03T05:22:23.916601Z","submitted_at":"2022-03-28T12:26:00Z","title":"Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14680","snapshot_observed_at":"2026-08-07T11:51:45.524038Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.524038Z"},"links":{"cited_paper":"/paper/2203.14680","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:df4c3ad7df04980c5ab4663ba548c081a520c44a0a7f34a80431d1b7638ae196","observation_id":"97cc80aa-5161-4654-8b2f-d7fee3097039","resolution":{"observed_at":"2026-08-07T11:51:45.524038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:45.599524Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.599524Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:0d58495e46fc7e5daf42ca6ab49d3051d7e037f9509405122f4587b498082879","observation_id":"dc021cae-e4ef-4b5b-ac49-42ecf781cdfc","resolution":{"observed_at":"2026-08-07T11:51:45.599524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.593413Z","title":null,"venue":null,"work_id":"01f8e4d8-17dd-4b14-80f5-bce9e6d90461","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.644887Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:6863aa48a2919aea3be8281bc690a8c8f8f91cf1e6d1c6b4cb295f3b98361a3f","observation_id":"8ab9c7df-6216-4c80-99c1-8961b32129b1","resolution":{"observed_at":"2026-08-07T11:52:03.678229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.407370Z","title":null,"venue":null,"work_id":"fcd47e3f-def9-42cd-829a-f90f574f1e34","year":2025},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.673129Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:1e567804ef939008b5ae5e05fa2cbec12a419f384582def2672efd3672607116","observation_id":"13e5232a-b22d-41fe-aa7b-1a76b076c743","resolution":{"observed_at":"2026-08-07T11:52:03.501080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.158431Z","title":null,"venue":null,"work_id":"2e229b0a-38e5-4b93-adb3-7bd75963592a","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.701034Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:e6eb51d3b2a2960c3700861d15816b2884280592995f520c4e71aa30db2987e5","observation_id":"ade7bf5a-a4fd-4569-995c-73b5dfb92e7b","resolution":{"observed_at":"2026-08-07T11:52:03.280322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T11:51:45.730983Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.730983Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:e8e00b90f2396f535b6d7cc656d1a5116709ff812f046c99f55e5ffe45b2720d","observation_id":"b369b048-ffc6-4cff-9c81-0d800aa88605","resolution":{"observed_at":"2026-08-07T11:51:45.730983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:03.041891Z","title":null,"venue":null,"work_id":"615d0715-9ad1-4b47-b894-c9e9a97480bb","year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.830582Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:517974b962a153322a2e3f8ea3a7f8d08b1a610228f7b78badafa52a738e28db","observation_id":"6b11ce9a-c206-4b83-b10c-f0812214de20","resolution":{"observed_at":"2026-08-07T11:52:03.119915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06367","last_updated":"2020-10-22T14:14:09Z","snapshot_observed_at":"2026-08-07T21:01:20.443312Z","submitted_at":"2020-09-14T17:45:36Z","title":"GeDi: Generative Discriminator Guided Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.06367","snapshot_observed_at":"2026-08-07T11:51:45.935133Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:45.935133Z"},"links":{"cited_paper":"/paper/2009.06367","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:e826bb2eebb2b569eebc623203c0e2f093cfa47f99e08c11e44bbb5a89217b4f","observation_id":"0928d240-736c-4e75-9763-2dd63715be2d","resolution":{"observed_at":"2026-08-07T11:51:45.935133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09573","last_updated":"2023-10-14T12:51:38Z","snapshot_observed_at":"2026-07-06T16:33:04.032904Z","submitted_at":"2023-10-14T12:51:38Z","title":"Self-Detoxifying Language Models via Toxification Reversal","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09573","snapshot_observed_at":"2026-08-07T11:51:46.053269Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.053269Z"},"links":{"cited_paper":"/paper/2310.09573","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:1f3e546266b44fb15ba5b6ed6306739fd2ca95f83b38f615308b0bd3275048de","observation_id":"a53f86f6-b837-4a99-ad2b-113983bc6c3b","resolution":{"observed_at":"2026-08-07T11:51:46.053269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.902295Z","title":null,"venue":null,"work_id":"64c3c050-af01-4cff-917e-b003353ac3de","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.151659Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:31c709074b683af98c65bf472b471d66e3af40a8fae5c4d1bc324cae99234edb","observation_id":"97660000-f33f-4754-8701-3310dbf88fb4","resolution":{"observed_at":"2026-08-07T11:52:02.974755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03772","last_updated":"2024-10-02T23:15:53Z","snapshot_observed_at":"2026-08-03T10:53:30.869578Z","submitted_at":"2024-10-02T23:15:53Z","title":"Precision Knowledge Editing: Enhancing Safety in Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.03772","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03772","snapshot_observed_at":"2026-08-07T11:51:56.049935Z","title":"Precision Knowledge Editing: Enhancing Safety in Large Language Models","venue":"cs.CL","work_id":"9a776804-e4d3-4b1a-935f-9f70b4223fb2","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.237788Z"},"links":{"cited_paper":"/paper/2410.03772","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:1b4dff0b46d75301f80e3ccf95e592b6e619060e42b75a682ed9edf27b14613a","observation_id":"016cd33c-8500-4650-950d-b7a098a65af6","resolution":{"observed_at":"2026-08-07T11:51:56.293516Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06668","last_updated":"2024-02-13T22:37:39Z","snapshot_observed_at":"2026-07-06T16:46:06.801011Z","submitted_at":"2023-11-11T21:19:44Z","title":"In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06668","snapshot_observed_at":"2026-08-07T11:51:46.326752Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.326752Z"},"links":{"cited_paper":"/paper/2311.06668","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:9b15eb25d34d790101fbd8fc971db6c9c1f7f76c6460090dd367f68f7be2f52b","observation_id":"b6b49cb8-5d42-4e9f-acc5-1c7f8bbca5fc","resolution":{"observed_at":"2026-08-07T11:51:46.326752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:46.402957Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.402957Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:876010d0b744c530e326bbe29d5a1eb3fbccef1833580558c5372886ef719bfa","observation_id":"f92ee00c-3f18-48b7-9c1a-98bb007513a9","resolution":{"observed_at":"2026-08-07T11:51:46.402957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:46.476104Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.476104Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:42d5047a12d26ed312a1c08228bd0f3037078e63a00dfe1105ac1f65eb38f394","observation_id":"e86c3c7a-4930-48b7-830f-c729ad1297e0","resolution":{"observed_at":"2026-08-07T11:51:46.476104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-07T11:51:46.551565Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.551565Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:850e6a1b0d794b06582a703649d514f54ee5cd286567830f8f5b02ded24dc072","observation_id":"ac449988-62f8-4712-83df-351a9a7db8bb","resolution":{"observed_at":"2026-08-07T11:51:46.551565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06947","last_updated":"2024-01-13T01:46:20Z","snapshot_observed_at":"2026-08-03T23:32:37.774749Z","submitted_at":"2024-01-13T01:46:20Z","title":"Parameter-Efficient Detoxification with Contrastive Decoding","version":1},"cited_work":{"arxiv_id":"2401.06947","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.06947","snapshot_observed_at":"2026-08-07T11:51:55.610600Z","title":"Parameter-Efficient Detoxification with Contrastive Decoding","venue":"cs.CL","work_id":"f4e02a96-20a1-4ae3-9b34-afeba818dfbd","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.641084Z"},"links":{"cited_paper":"/paper/2401.06947","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:17e3a91a5f10a478a6b7e9cd9336e661eb3b3b38b8e4f51fbefed71581b75f97","observation_id":"ff750c46-6b22-4fb8-8a5a-04863c8fcb3e","resolution":{"observed_at":"2026-08-07T11:51:55.719667Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.714223Z","title":null,"venue":null,"work_id":"3ad1f99f-1867-4bdd-808b-a2a80fc7972e","year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.755987Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:574525c9de7fd28b772f0ce3ed36fe27d95f4d6406fe6c41114b4c749973bd17","observation_id":"b4b8de2f-d822-4963-8cfd-74d13705dcb4","resolution":{"observed_at":"2026-08-07T11:52:02.781299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-07T11:51:46.840713Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.840713Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:42ae0ca1966f7464491996aebf40afbb00c061f9a67b0b054de72735c36f00c5","observation_id":"1eb3da40-2bbc-46d0-9eaf-6016d3d7e52c","resolution":{"observed_at":"2026-08-07T11:51:46.840713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.521517Z","title":null,"venue":null,"work_id":"3c1cb3a4-d323-48e2-a12c-e64259d7e479","year":2014},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:46.920151Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:6304ae0efb2ddc7af480b4c46993dc54e1f57adb17928b7631a94e538d9457f2","observation_id":"06349381-7883-45cd-a579-a66af14320c6","resolution":{"observed_at":"2026-08-07T11:52:02.616160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:47.048666Z","title":"Peters, Mark Neumann, Mohit Iyyer, Matt Gardner, Christopher Clark, Kenton Lee, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.048666Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:a15ea871b01ab605613740a5b9a6ae9ff2e896502c1eb2db6c8feed052ea79be","observation_id":"10828be9-e92e-4d9d-b240-01634ddabaf0","resolution":{"observed_at":"2026-08-07T11:51:47.048666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.362642Z","title":null,"venue":null,"work_id":"9e8494d4-e4c2-4f33-a0a9-76fff0e74f35","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.186646Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:eadc3d9cc5b31662c80686d013184570e656f85caad284b30a009d7becbbdc20","observation_id":"d0599b91-af16-4420-a3f3-76c91bd425d9","resolution":{"observed_at":"2026-08-07T11:52:02.435758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.194729Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":"6fed4f8e-6aec-4bd1-be56-cad9c0ae5d50","year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.425663Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:74ba6b36fa73e1f035381077efb1b2e3d46a6ad1316c2370114a36b4965c348f","observation_id":"00e05e4a-2bc7-486f-8c7b-66fe99146878","resolution":{"observed_at":"2026-08-07T11:52:02.287963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:02.017356Z","title":null,"venue":null,"work_id":"c5c061c0-e93d-4e9a-a351-88d686498bb0","year":2021},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.678852Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:99b4e0112021128655f3b320fa636894b6bfc0cc466feeac2e430cfbb6c5c6d9","observation_id":"26b6142c-5166-406b-927e-f24aae360ca7","resolution":{"observed_at":"2026-08-07T11:52:02.095429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:47.834752Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.834752Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:037ff9535213410d2f72e8336b411b9ec71fc7dfc3a32a1df836dca6b273a9fd","observation_id":"93a055b5-6c24-4c7b-883a-4ac523369648","resolution":{"observed_at":"2026-08-07T11:51:47.834752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:47.904434Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.904434Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:76f4b2c13c1d93738eeb8b2eb73c17d8fb34f5019d87b67f395de38a07d7a716","observation_id":"eeabb20c-47ab-4542-8326-239378930f87","resolution":{"observed_at":"2026-08-07T11:51:47.904434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:01.834095Z","title":null,"venue":null,"work_id":"0f7baf1a-5768-4714-9b17-5ee13730a6e6","year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:47.961916Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:967baf9c95d8c7d9fbb222c7985b8b64a1b26b4ef1bbf67a43c64c8b46573270","observation_id":"b5d80c8a-968b-4eaf-905d-50cbfe38a651","resolution":{"observed_at":"2026-08-07T11:52:01.912627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:52:00.548213Z","title":null,"venue":null,"work_id":"a8ce06b3-d667-4adc-8865-4e08849afbe6","year":2018},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.022425Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:f83f2c2a53ef03a2484558bfe449f31e8de68728698d6fe42bb68cff5a1cea49","observation_id":"4bb94026-2d27-4793-ae04-62a27ef08797","resolution":{"observed_at":"2026-08-07T11:52:01.205023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.01279","last_updated":"2021-05-04T04:08:58Z","snapshot_observed_at":"2026-08-04T19:01:56.567591Z","submitted_at":"2021-05-04T04:08:58Z","title":"ZEN 2.0: Continue Training and Adaption for N-gram Enhanced Text Encoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.01279","snapshot_observed_at":"2026-08-07T11:51:48.152786Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.152786Z"},"links":{"cited_paper":"/paper/2105.01279","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:ec870a9a052bbfad7e1a13bac6d11fce19f133fdb686f6f97f6fbd0598ee87a2","observation_id":"9edaf56a-78b6-45dd-aba5-94c27b9fddc4","resolution":{"observed_at":"2026-08-07T11:51:48.152786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:48.328718Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.328718Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:bba17f9575e740347a1d3b1eca782016d68ace17be64f52030be99f5948a7665","observation_id":"bed7ebfc-c274-4607-8b60-7f9b37f9d9cc","resolution":{"observed_at":"2026-08-07T11:51:48.328718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:48.514174Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.514174Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:82ee48120a308efba95f349bc0ecb810796b8ba4f0ce8cbb0f9dfe03bd4e786d","observation_id":"c942f8a5-1c0f-49a6-825f-f6e59c35dc7e","resolution":{"observed_at":"2026-08-07T11:51:48.514174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:48.761372Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.761372Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:9aed195e6197d117c3b1665ab4d5153ce2a01b4f4a07e7dcf4a4538ba6b46201","observation_id":"4eff3e0d-489d-4049-bfed-78516ee1fd8a","resolution":{"observed_at":"2026-08-07T11:51:48.761372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:59.792222Z","title":null,"venue":null,"work_id":"db664730-2479-40ce-ad9e-d6a52f62db18","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:48.976916Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:497cf21ac9c0d884b3c00b8d334af537e90039d57ccd2f1eda7724182bfc54f7","observation_id":"d3adda92-cfe3-46f2-bcda-1c03309856af","resolution":{"observed_at":"2026-08-07T11:52:00.071296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:59.241141Z","title":null,"venue":null,"work_id":"9a63651a-8743-4c1c-b0c3-8e4b4efcf8c1","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:49.154907Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:bddde40f0f141634af480c41b98babc5cdf73d787ae5329b8c77a359e7c2f7e6","observation_id":"ad73e881-8426-4ee9-bce3-a3e4cc3adf99","resolution":{"observed_at":"2026-08-07T11:51:59.500034Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T11:51:49.331347Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:49.331347Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:0f0a1816127385e72d8bf556d0d88d1251d564944e621cd34d0761d094fe7581","observation_id":"f6e667d0-dcb9-45be-841c-4b9768301b70","resolution":{"observed_at":"2026-08-07T11:51:49.331347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13967","last_updated":"2025-03-01T01:35:47Z","snapshot_observed_at":"2026-07-06T18:18:12.096996Z","submitted_at":"2024-05-22T20:08:48Z","title":"Model Editing as a Robust and Denoised variant of DPO: A Case Study on Toxicity","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13967","snapshot_observed_at":"2026-08-07T11:51:49.597443Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:49.597443Z"},"links":{"cited_paper":"/paper/2405.13967","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:1efdccdac19aad54191b89644b95f76b23e4f6a7d0db942ed6c2bfa422239448","observation_id":"baa25229-99c8-470e-8a81-0cd560c40f4a","resolution":{"observed_at":"2026-08-07T11:51:49.597443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:58.314583Z","title":null,"venue":null,"work_id":"0aea7d81-d2a6-409a-92ab-24a2fccb22e3","year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:50.029694Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:e889f42e70b63914b11009eef68afc5c4ca46e6695662060aee7ba9f922d6018","observation_id":"0e4da451-3a45-4c81-9d64-8d953cb11c8e","resolution":{"observed_at":"2026-08-07T11:51:59.025581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:51:57.021940Z","title":null,"venue":null,"work_id":"079c3060-e8cb-45d7-bf5a-f5a57959f67a","year":2022},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:50.491614Z"},"links":{"citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:843c742e9ab841f4b453112dbbe7c0af31f6b6212aa8f378e145e55c31fc692f","observation_id":"863f590a-89a7-40c0-8111-6dd071d76196","resolution":{"observed_at":"2026-08-07T11:51:57.530766Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14472","last_updated":"2024-05-28T09:11:25Z","snapshot_observed_at":"2026-07-06T17:48:24.076444Z","submitted_at":"2024-03-21T15:18:30Z","title":"Detoxifying Large Language Models via Knowledge Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14472","snapshot_observed_at":"2026-08-07T11:51:51.205902Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:51.205902Z"},"links":{"cited_paper":"/paper/2403.14472","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:4dcdb6dd42616ff6c5c70307823c9dcf0a7e6ec4ed3085bfd6173b264a4b2cb8","observation_id":"b1890723-a92b-423f-bed2-768d20cd11e2","resolution":{"observed_at":"2026-08-07T11:51:51.205902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14688","last_updated":"2024-06-18T03:17:18Z","snapshot_observed_at":"2026-07-06T17:20:45.227692Z","submitted_at":"2024-01-26T07:17:50Z","title":"Taiyi-Diffusion-XL: Advancing Bilingual Text-to-Image Generation with Large Vision-Language Model Support","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14688","snapshot_observed_at":"2026-08-07T11:51:52.409165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:52.409165Z"},"links":{"cited_paper":"/paper/2401.14688","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:2255ea4fc5326aac863f0ba4bd60021c2ed1d36731c22fd28c7e3d599a28da81","observation_id":"f649639a-6536-4191-b00d-84b1bb1e4f21","resolution":{"observed_at":"2026-08-07T11:51:52.409165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02958","last_updated":"2025-06-17T07:41:08Z","snapshot_observed_at":"2026-08-09T20:38:41.023817Z","submitted_at":"2025-02-05T07:51:32Z","title":"Position: Editing Large Language Models Poses Serious Safety Risks","version":3},"cited_work":{"arxiv_id":"2502.02958","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.02958","snapshot_observed_at":"2026-08-07T11:51:55.251367Z","title":"Position: Editing Large Language Models Poses Serious Safety Risks","venue":"cs.CL","work_id":"e67ec0bb-f431-4847-9ee2-87aecd0946dd","year":2025},"citing_paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:51:54.491362Z"},"links":{"cited_paper":"/paper/2502.02958","citing_paper":"/paper/2506.01266"},"observation_digest":"sha256:444843646dfc9a7e1b0d2a1f6b97c6fc9711f4554ab8fd1384a05d1fe88345a5","observation_id":"7290928f-4e26-4d5d-a66e-63c19beb25be","resolution":{"observed_at":"2026-08-07T11:51:55.414117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01266","last_updated":"2025-06-02T02:36:32Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T19:27:35.725295Z","submitted_at":"2025-06-02T02:36:32Z","title":"Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":4,"verified_fuzzy":1},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2506.01266."}