{"as_of":"2026-08-12T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c6a78d6d4541064bdf7ef33cee5219ebe4a9115e35b01aff08277eddcf0c427","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:33:59.640530Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.06843/citation-record","integrity":"/paper/2412.06843/integrity","json":"/paper/2412.06843/citation-record.json","paper":"/paper/2412.06843"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-11T04:34:07.318549Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-11T20:33:59.554020Z","title":"Fine-tuning language models from human preferences","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.554020Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:130c586cb5b67a637b67b938cb30f7c6b28dff14e5fb1386bb54834f6b4b47fb","observation_id":"15a04b44-2169-4193-9f1b-3e5fc76338e1","resolution":{"observed_at":"2026-08-11T20:33:59.554020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-11T20:33:59.557825Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.557825Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:a402021136fc5d370d4dd678720320067f688cde76893ebb8ea9b54bae8f8eb6","observation_id":"d444e7d5-cb5b-4337-8bec-7d199fa225d0","resolution":{"observed_at":"2026-08-11T20:33:59.557825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07875","last_updated":"2024-03-19T16:50:50Z","snapshot_observed_at":"2026-08-06T23:45:57.910675Z","submitted_at":"2023-09-14T17:23:37Z","title":"Safety-Tuned LLaMAs: Lessons From Improving the Safety of Large Language Models that Follow Instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07875","snapshot_observed_at":"2026-08-11T20:33:59.561706Z","title":"Safety-tuned llamas: Lessons from improving the safety of large language models that follow instructions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.561706Z"},"links":{"cited_paper":"/paper/2309.07875","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:58b1a8f429e7f3001f91862946c653a1ce75c1be068756c0aa7ab20d5d83604c","observation_id":"085d205f-8cdb-41d1-87e7-c66fa1ef3d0f","resolution":{"observed_at":"2026-08-11T20:33:59.561706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17493","last_updated":"2024-04-14T05:20:10Z","snapshot_observed_at":"2026-08-05T16:03:40.517679Z","submitted_at":"2023-05-27T15:10:41Z","title":"The Curse of Recursion: Training on Generated Data Makes Models Forget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17493","snapshot_observed_at":"2026-08-11T20:33:59.565711Z","title":"The curse of recursion: Training on generated data makes models forget","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.565711Z"},"links":{"cited_paper":"/paper/2305.17493","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:4cc99a3a6e7abcafc1a941d4e810c9868356b7d198dab4b5f2d794599561d23a","observation_id":"e16bfab0-ae79-454e-945f-b81c262ea90e","resolution":{"observed_at":"2026-08-11T20:33:59.565711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10019","last_updated":"2024-10-05T06:50:15Z","snapshot_observed_at":"2026-08-06T04:21:24.397587Z","submitted_at":"2024-01-18T14:40:46Z","title":"R-Judge: Benchmarking Safety Risk Awareness for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10019","snapshot_observed_at":"2026-08-11T20:33:59.569717Z","title":"R-judge: Benchmarking safety risk awareness for llm agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.569717Z"},"links":{"cited_paper":"/paper/2401.10019","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:6c02eab255026b0130ae9d45f6d3303541d581057e10cb10f5344a199b588496","observation_id":"988817a1-8dd4-4379-ab0a-cdb181cabc28","resolution":{"observed_at":"2026-08-11T20:33:59.569717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07691","last_updated":"2024-03-14T07:47:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T14:34:08Z","title":"ORPO: Monolithic Preference Optimization without Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07691","snapshot_observed_at":"2026-08-11T20:33:59.574024Z","title":"Orpo: Monolithic preference optimization without reference model.arXiv preprint arXiv:2403.07691, 2(4):5,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.574024Z"},"links":{"cited_paper":"/paper/2403.07691","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:3c738187433ebcaab0d2a2be249d0abf28327d2f7c03c3bbefd85aa051b37ade","observation_id":"d27409a3-dc29-48ef-ad1e-97ebab1d9c08","resolution":{"observed_at":"2026-08-11T20:33:59.574024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-11T20:33:59.578757Z","title":"Kto: Model alignment as prospect theoretic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.578757Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:96e6478f18b16737f97d1c265502384b9cd8ca651669ca78db2c7e827034d5fd","observation_id":"09f16256-67d0-4308-ac73-4385e1aa14a7","resolution":{"observed_at":"2026-08-11T20:33:59.578757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02207","last_updated":"2024-06-17T22:26:32Z","snapshot_observed_at":"2026-08-09T09:35:21.862266Z","submitted_at":"2024-02-03T16:43:42Z","title":"Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02207","snapshot_observed_at":"2026-08-11T20:33:59.583034Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.583034Z"},"links":{"cited_paper":"/paper/2402.02207","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:064746baccec22611db432ebfbf1ffb21eb9ae044fbbdab50af80e3a50a438b8","observation_id":"a7c02c9a-27b9-43be-af1b-bac8b97313e5","resolution":{"observed_at":"2026-08-11T20:33:59.583034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03693","last_updated":"2023-10-05T17:12:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-05T17:12:17Z","title":"Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03693","snapshot_observed_at":"2026-08-11T20:33:59.587315Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to! arXiv preprint arXiv:2310.03693,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.587315Z"},"links":{"cited_paper":"/paper/2310.03693","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:ce178f74b6d6dde737981e0af25efff556b6798ab85b20c4e1a639e7b2603b26","observation_id":"0a7c882e-489e-49f7-aed1-b97b597e2b0d","resolution":{"observed_at":"2026-08-11T20:33:59.587315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16833","last_updated":"2025-01-05T21:51:46Z","snapshot_observed_at":"2026-07-31T00:03:11.135660Z","submitted_at":"2024-05-27T05:04:05Z","title":"Safe LoRA: the Silver Lining of Reducing Safety Risks when Fine-tuning Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16833","snapshot_observed_at":"2026-08-11T20:33:59.593520Z","title":"Safe lora: the silver lining of reducing safety risks when fine-tuning large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.593520Z"},"links":{"cited_paper":"/paper/2405.16833","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:9219694819b5c6adfa9d99b490022243c77b366114405859eb6bdbfa2887a7a5","observation_id":"d91eca39-ba59-410f-a4be-552abe4e1306","resolution":{"observed_at":"2026-08-11T20:33:59.593520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T20:33:59.600583Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.600583Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:51cdfa04620f59d0d3080bf9ea4cb4086a3ac1a68ce12399457940e3484ee37b","observation_id":"19576853-9900-4303-a4d6-936240f74637","resolution":{"observed_at":"2026-08-11T20:33:59.600583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-11T20:33:59.603933Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.603933Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:2be420e108a6f16d435fa4aa7c46f393d7fe7fc30a9f21720d3e0f9821aed5f1","observation_id":"d83a6bf1-59e9-4e45-a6d4-1930296d5e01","resolution":{"observed_at":"2026-08-11T20:33:59.603933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T20:33:59.608238Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.608238Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:4d27e0f902980abf25b75e755f01f8cb09012b0a631e15728bd501bb7a853b49","observation_id":"66f137b4-4828-4e31-9dd9-a0f91ccef01c","resolution":{"observed_at":"2026-08-11T20:33:59.608238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T20:33:59.611336Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.611336Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:a2ca46eb0ac273882ad9f935eba69ac57c4531aedc9750df51b5f0c6a97fb46d","observation_id":"022c2652-7026-4eee-8df1-90bc1ac82942","resolution":{"observed_at":"2026-08-11T20:33:59.611336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-11T20:33:59.619238Z","title":"Debertav3: Improving deberta using electra-style pre-training with gradient-disentangled embedding sharing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.619238Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:0d8440f14b14f4c7b63caa066df3c29ffc902eefe561003dbab841e965530116","observation_id":"31f68ea1-ff3c-431d-92b6-f9861cefe203","resolution":{"observed_at":"2026-08-11T20:33:59.619238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-11T20:33:59.622547Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.622547Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:d55611a685cea8c6e281fdba3f0216a4621acc0ccb3822a57a755ef4241b8a36","observation_id":"642c39c9-0c7c-440a-a1b0-6bac0444c4c6","resolution":{"observed_at":"2026-08-11T20:33:59.622547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-11T20:33:59.627999Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.627999Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:612bd674f10379704af004af7c27bdbe04dee6023bb5eb43a97c5537c4ca6860","observation_id":"6a2cc4e8-3893-4068-b9a2-368cb93a7940","resolution":{"observed_at":"2026-08-11T20:33:59.627999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:33:59.633260Z","title":"Jason Wei, Maarten Bosma, Vincent Y Zhao, Kelvin Guu, Adams Wei Yu, Brian Lester, Nan Du, Andrew M Dai, and Quoc V Le","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.633260Z"},"links":{"citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:605bc2c55b65e47e1ff16a4f37d99dd96d7e659f3896af0e8e35c7e7265d7ae7","observation_id":"c6c13ad7-23f0-4c10-a127-758aa0bd4237","resolution":{"observed_at":"2026-08-11T20:33:59.633260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01263","last_updated":"2024-04-01T11:50:35Z","snapshot_observed_at":"2026-08-03T00:58:55.865010Z","submitted_at":"2023-08-02T16:30:40Z","title":"XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01263","snapshot_observed_at":"2026-08-11T20:33:59.636728Z","title":"Xstest: A test suite for identifying exaggerated safety behaviours in large language models.arXiv preprint arXiv:2308.01263,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.636728Z"},"links":{"cited_paper":"/paper/2308.01263","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:c92e931d8d2f32c33e7b3cde85be86b1669cfc082d7fbd6e7bf9bd81280f6aab","observation_id":"163bf31f-14b5-4e4e-8ec7-e2fca2c8cf32","resolution":{"observed_at":"2026-08-11T20:33:59.636728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-11T20:33:59.640530Z","title":"Mixtral of experts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.640530Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:d08bec6982cd748d3744e1ac45c1cbb736ce0cc74a31469fea5f4799e8eaea3c","observation_id":"96a2d0ac-c57e-4ad8-b07b-39052ee0a6ab","resolution":{"observed_at":"2026-08-11T20:33:59.640530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04691","last_updated":"2024-02-02T04:25:02Z","snapshot_observed_at":"2026-08-09T16:23:22.438320Z","submitted_at":"2023-10-07T05:37:41Z","title":"EMO: Earth Mover Distance Optimization for Auto-Regressive Language Modeling","version":7},"cited_work":{"arxiv_id":"2310.04691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.04691","snapshot_observed_at":"2026-08-11T20:34:00.051875Z","title":"EMO: Earth Mover Distance Optimization for Auto-Regressive Language Modeling","venue":"cs.CL","work_id":"1460049f-6f86-49b5-a7af-58ff8dc9f880","year":2023},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.597221Z"},"links":{"cited_paper":"/paper/2310.04691","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:e1d86ec6d2fc7f722cde3d4b51f2db087cbed29b709108020a4c6899335e2cae","observation_id":"e70ce04d-a079-475a-873b-aae12b9ae1a5","resolution":{"observed_at":"2026-08-11T20:34:00.061075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T20:33:59.550341Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.550341Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:99f8307d90b5aa95b6ecbe5a489162aaef1f5d78bf3b75a6b73aa1dce8d012d4","observation_id":"47277483-7306-46d7-8541-2584d40c8870","resolution":{"observed_at":"2026-08-11T20:33:59.550341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01326","last_updated":"2019-10-23T18:55:16Z","snapshot_observed_at":"2026-08-12T02:00:49.013542Z","submitted_at":"2019-09-03T17:50:44Z","title":"The Woman Worked as a Babysitter: On Biases in Language Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01326","snapshot_observed_at":"2026-08-11T20:33:59.546061Z","title":"The woman worked as a babysitter: On biases in language generation","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.546061Z"},"links":{"cited_paper":"/paper/1909.01326","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:95c7aaa70746789e1980324769e23357e71ae25cf6689905b6bd93621aa57273","observation_id":"7d4f8019-7807-4045-a846-246cb306d110","resolution":{"observed_at":"2026-08-11T20:33:59.546061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20947","last_updated":"2025-06-15T21:44:25Z","snapshot_observed_at":"2026-07-06T18:23:23.565502Z","submitted_at":"2024-05-31T15:44:33Z","title":"OR-Bench: An Over-Refusal Benchmark for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20947","snapshot_observed_at":"2026-08-11T20:33:59.615309Z","title":"Or-bench: An over-refusal benchmark for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.615309Z"},"links":{"cited_paper":"/paper/2405.20947","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:b6d071bea196bd12d9fe3cd954c60287628a0de8fe10dfd22ce8110b93c539ea","observation_id":"7490d506-06b8-4faf-97c7-129aafd999db","resolution":{"observed_at":"2026-08-11T20:33:59.615309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17391","last_updated":"2023-11-29T06:42:36Z","snapshot_observed_at":"2026-08-09T19:32:35.322669Z","submitted_at":"2023-11-29T06:42:36Z","title":"Unveiling the Implicit Toxicity in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17391","snapshot_observed_at":"2026-08-11T20:33:59.537032Z","title":"Unveiling the implicit toxicity in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.537032Z"},"links":{"cited_paper":"/paper/2311.17391","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:89f4a84f5d171dd4f0c5e52400846f95c58b3adb23e8e5aee14c1e8be06d8358","observation_id":"34fd8d9a-a25c-47c5-a20c-84e37a734807","resolution":{"observed_at":"2026-08-11T20:33:59.537032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-08-09T05:10:26.091710Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-08-11T20:33:59.541946Z","title":"Realtoxicityprompts: Evaluating neural toxic degeneration in language models","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.541946Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:9e960e9f599462420631a598e40cea51a80dd9a3c29dc00e2525ded3cb8744b0","observation_id":"bc2a4973-20ac-45a6-bea0-8c0ad398d8a2","resolution":{"observed_at":"2026-08-11T20:33:59.541946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:34:00.366366Z","title":"Predictability and surprise in large generative models","venue":null,"work_id":"61add492-8613-4ddc-8236-299dc591fbde","year":2025},"citing_paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T20:33:59.531618Z"},"links":{"citing_paper":"/paper/2412.06843"},"observation_digest":"sha256:be320994623a0e35bac2eacd06b5a23c04db3722d8d8a72a0eeab70377ef9398","observation_id":"588e621b-2853-4f89-8348-1f57d7e05664","resolution":{"observed_at":"2026-08-11T20:34:00.377140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.06843","last_updated":"2024-12-11T12:35:25Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T02:01:12.990959Z","submitted_at":"2024-12-07T16:35:14Z","title":"Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2412.06843."}