{"as_of":"2026-08-18T16:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:45c1e5b56a53625a4d4f24169f01388d30dedc07dd4c6bc397f32288969ad0a3","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T21:47:02.992276Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.15977/citation-record","integrity":"/paper/2607.15977/integrity","json":"/paper/2607.15977/citation-record.json","paper":"/paper/2607.15977"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:46:59.214081Z","title":"2026 , isbn =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.214081Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:9144cf1b4dc1827f08db48a7e711f6724c22eeea6867d4452a49b5ea29be4934","observation_id":"d00c10e2-a451-457f-a55b-b5162d1adc0b","resolution":{"observed_at":"2026-08-01T21:46:59.214081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:46:59.250762Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.250762Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:049ce79df64b791bb5863d3efce833a2a92a9db9b19af7959dddc28273638ad4","observation_id":"da6bc5dc-c63b-40cb-b991-674561f72688","resolution":{"observed_at":"2026-08-01T21:46:59.250762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.884","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Jain, Lalit K and Nowak, Robert D and Mankoff, Bob and Zhang, Jifan","venue":null,"work_id":"89a759a3-4189-4b35-be94-b1b040ca5d36","year":2025},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.333964Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:8356ebea3859cb6ed45899874f960d9d65511234eec0d9b7bfc1dbd8491ff363","observation_id":"8d0db242-5ba6-42ef-93f8-d354a5618946","resolution":{"observed_at":"2026-08-01T21:48:23.550091Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.706","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Small But Funny: A Feedback-Driven Approach to Humor Distillation","venue":null,"work_id":"9c6788b3-23d8-4235-8eeb-4a2a3152a979","year":2024},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.410963Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:6460a3bd349c077474aaf3aab47be946b7f2f17f549744723bc7db7b39d84979","observation_id":"0d4e8f00-1de4-4374-99d9-950de50da173","resolution":{"observed_at":"2026-08-01T21:48:23.247303Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1419","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pun Unintended: LLM s and the Illusion of Humor Understanding","venue":null,"work_id":"f5934a8e-403f-42e1-863f-e17dd1bda723","year":2025},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.497085Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:42d3f19e933f33412b6fa41a2ec94b47f393235dab6cd689144612e33c9e0811","observation_id":"c251c4ea-5caf-4751-8fd6-9ccb20b9e448","resolution":{"observed_at":"2026-08-01T21:48:22.969822Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:46:59.574639Z","title":"2024 , isbn =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.574639Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:eb1069505bd041024cde328fe07caa4bc0ad563b17d21090cefb8a7490d5c27e","observation_id":"e2b425c1-0c06-4467-a7bb-8fef9088760d","resolution":{"observed_at":"2026-08-01T21:46:59.574639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.eacl-long.373","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Engagement Undermines Safety: How Stereotypes and Toxicity Shape Humor in Language Models","venue":null,"work_id":"da2437b4-8bfd-4df0-af57-d33ab60bac38","year":2026},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.659930Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:f8a9b0dabdf1c8c7d412d2952618c365e59b0e5cf57dc5404080b8a34649cc18","observation_id":"231cf2a2-8af6-485d-862b-e5f37f023f0e","resolution":{"observed_at":"2026-08-01T21:48:22.811132Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:46:59.743705Z","title":"arXiv preprint arXiv:2603.17759 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.743705Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:f9f85336505e4dcbe992e8e661c7dc17b493aed6f8b9d3a2cb2e3a47bf9901d2","observation_id":"49451c19-92e7-4b23-b306-f3e8477008b5","resolution":{"observed_at":"2026-08-01T21:46:59.743705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:46:59.817854Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.817854Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:4ff15ff903b4e5cd043d4d34961cd40076414f43eebf5bc75809ac3ea6df06b3","observation_id":"8ad4d120-1488-4fef-81fc-319e04fd7fba","resolution":{"observed_at":"2026-08-01T21:46:59.817854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:46:59.902434Z","title":"ICML 2026 , year=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.902434Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:532f084d522c3fe86f2ecf2e0c5240b2d81cd454940346456b0d8852f1686371","observation_id":"e2292e0e-af6e-4c70-8b09-25448e10a053","resolution":{"observed_at":"2026-08-01T21:46:59.902434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:46:59.986828Z","title":"Getting Serious about Humor: Crafting Humor Datasets with Unfunny Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T21:46:59.986828Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:49e9b9d441d5f327a9eea20b9017004a2a5103bcb11b74db54667bcd33a9d9b8","observation_id":"801be5ed-3fb4-4ca8-8b89-25ac015e97d1","resolution":{"observed_at":"2026-08-01T21:46:59.986828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.1122","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chumor 2.0: Towards Better Benchmarking C hinese Humor Understanding from (Ruo Zhi Ba)","venue":null,"work_id":"cb5bfb19-418a-4637-b5fd-6a3b581afdfd","year":2025},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:00.071256Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:00dc68ad5cb2f4f8830abd3cd0855c0a92ac36518dd98ec362ab3bb1155857eb","observation_id":"ac00da6f-e595-4d55-beb5-fc7b71980d0d","resolution":{"observed_at":"2026-08-01T21:48:22.621662Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12754","last_updated":"2024-06-18T16:22:05Z","snapshot_observed_at":"2026-08-16T13:41:46.039492Z","submitted_at":"2024-06-18T16:22:05Z","title":"Chumor 1.0: A Truly Funny and Challenging Chinese Humor Understanding Dataset from Ruo Zhi Ba","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12754","snapshot_observed_at":"2026-08-01T21:47:00.171514Z","title":"arXiv preprint arXiv:2406.12754 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:00.171514Z"},"links":{"cited_paper":"/paper/2406.12754","citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:c45ab5e9241ecfcdf11c85d5c18251eaae7d0b229449a7a552ad8bcd11286c9f","observation_id":"2aae92ec-fea7-459d-b20e-aebebaf1df51","resolution":{"observed_at":"2026-08-01T21:47:00.171514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:00.251140Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:00.251140Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:8ca3f54f6199d4391521c61f354e7cd30abd3fdc7bd7d5528c3c0d1844b72dfc","observation_id":"9ed88eb5-da00-4681-af60-152b06456e23","resolution":{"observed_at":"2026-08-01T21:47:00.251140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:00.391154Z","title":"Incomplete Prompt Jailbreaks in Large Language Models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:00.391154Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:70c4e2406eeb0902cbaeb37fcbe9666ddf2e6ad636064c17431494153dac9fa2","observation_id":"ed96807e-efa9-45ff-bbd0-8f69125ef509","resolution":{"observed_at":"2026-08-01T21:47:00.391154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:00.562639Z","title":"Adjacent Words, Divergent Intents: Jailbreaking Large Language Models via Task Concurrency , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:00.562639Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:23a6cffbba9272939743aa13ba1245c8a1dc7b28d708f594125f9e5cef07b56a","observation_id":"a58fdeea-1000-457e-b6cc-23162859590d","resolution":{"observed_at":"2026-08-01T21:47:00.562639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:00.681639Z","title":"2024 , isbn =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:00.681639Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:4cdec9e5a729b2a4b4779f1383300d05718d95a379a1861f8064510320ea6bd9","observation_id":"635f8b6e-abe6-4ef2-96b1-38a5f73bcde4","resolution":{"observed_at":"2026-08-01T21:47:00.681639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:00.825299Z","title":"2025 , isbn =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:00.825299Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:56e1bc889d816c8c94d68e15700a53159552143eac411c755c1c10b1d9c1fe2e","observation_id":"4f7a9a9a-fd45-4bf4-9120-8fcf7dfd4105","resolution":{"observed_at":"2026-08-01T21:47:00.825299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:00.931734Z","title":"33rd USENIX Security Symposium (USENIX Security 24) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:00.931734Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:56da8de8169ff57b20ff3c8cc3722e92ee4f6280a2e96b89ec66701b5e408de8","observation_id":"128e6b02-ed6d-4fb8-a677-bb1c3cea5503","resolution":{"observed_at":"2026-08-01T21:47:00.931734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:01.045844Z","title":"Rothblum , booktitle=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:01.045844Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:8a4bd82360e761e5cb2eee52e1b06af86de5e5099cabe824eacaca76814c7f2d","observation_id":"aaad7948-05c9-4d22-ae6c-be7e1c74d4af","resolution":{"observed_at":"2026-08-01T21:47:01.045844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:01.086898Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:01.086898Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:65e590cb22485139ea014a7702e74ff3a532b1641496b157bf59c948a578f25e","observation_id":"3e05f6ce-6445-47fb-93ad-cdc56cadc595","resolution":{"observed_at":"2026-08-01T21:47:01.086898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-14T02:46:12.121034Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-01T21:47:01.180010Z","title":"arXiv preprint arXiv:2508.10925 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:01.180010Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:dfdd783183430b674be030f24d6a01d03af337ec8d49cc69a7b842b79513472a","observation_id":"3be2e25c-c8fd-44d8-ac54-2c0cabb13eda","resolution":{"observed_at":"2026-08-01T21:47:01.180010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.acl-long.431","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:48:22.224493Z","title":"OS -Sentinel: Towards Safety-Enhanced Mobile GUI Agents via Hybrid Validation in Realistic Workflows","venue":null,"work_id":"5e568b5b-fe15-4297-a4a5-9ca454b8206c","year":2026},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:01.262257Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:352784875a224ec632e4b69bda8e2ef4cad4e281c67bea2e524e96200bfabc4a","observation_id":"62c8ff9b-b573-46e6-8cf0-087eeb2f3096","resolution":{"observed_at":"2026-08-01T21:48:22.337470Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:01.375929Z","title":"arXiv preprint arXiv:2601.10527 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:01.375929Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:78543c5d398a8dc4a00d971c0e2611ea5c2c615f0249bcdb7c06189d3c9d7edc","observation_id":"a7f3c676-74ee-4de1-89bc-1db186f1c5d7","resolution":{"observed_at":"2026-08-01T21:47:01.375929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:01.515989Z","title":"Proceedings of the 34th USENIX Conference on Security Symposium , articleno =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:01.515989Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:0438cc665d8ab897eefc475f1118226b6175a0084e2ace495b41694ec0e4a350","observation_id":"301d3e81-7332-4677-9117-8484f79131c8","resolution":{"observed_at":"2026-08-01T21:47:01.515989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:01.644159Z","title":"34th USENIX Security Symposium (USENIX Security 25) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:01.644159Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:772605ca69881e6118b0322d883d69da2f7bedef97d48c4ba0c84c7dda1b5a50","observation_id":"f65f516e-f30c-45a8-9016-7cfe9257966c","resolution":{"observed_at":"2026-08-01T21:47:01.644159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30883","last_updated":"2026-05-29T06:13:58Z","snapshot_observed_at":"2026-08-12T14:45:19.898990Z","submitted_at":"2026-05-29T06:13:58Z","title":"TRACE: Task-Aware Adaptive Self-Evolving Agentic Jailbreaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30883","snapshot_observed_at":"2026-08-01T21:47:01.765950Z","title":"arXiv preprint arXiv:2605.30883 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:01.765950Z"},"links":{"cited_paper":"/paper/2605.30883","citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:b5daf3f4594bf0eb4a29da53351b84c8e9ceb81ac4d7b962d5d4968c7bab2405","observation_id":"88c93aa0-0367-4240-95d8-dadbbe8514c0","resolution":{"observed_at":"2026-08-01T21:47:01.765950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:01.924481Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:01.924481Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:3242985899a1a2350a3674f443118af2fb174a7c8a94d90c1933b0511e106ab0","observation_id":"91f50f54-ab44-40d8-aa45-50da8411fe5b","resolution":{"observed_at":"2026-08-01T21:47:01.924481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-naacl.219","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vulnerability of Large Language Models to Output Prefix Jailbreaks: Impact of Positions on Safety","venue":null,"work_id":"1ee4a5bf-6f55-496a-a64d-4127e4baa7ed","year":2025},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.084533Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:a61aa609713e9a1db37b1c961b64ce1873ee78a369be23fa3ac6daeee4795960","observation_id":"9597f2b5-eaa0-4e58-8c84-75cc6ede34a5","resolution":{"observed_at":"2026-08-01T21:48:22.101117Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:02.252833Z","title":"Humans welcome to observe","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.252833Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:5dbb06a79f8b2a02e6e40f78a3231ade4ef68f5dbd747f6f1f2da41baba4d2ae","observation_id":"640a0cd5-e7da-4f5e-86be-223175b8d369","resolution":{"observed_at":"2026-08-01T21:47:02.252833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:02.391217Z","title":"and Chu, Eric and Behbahani, Feryal and Faust, Aleksandra and Larochelle, Hugo , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.391217Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:fd157408cf10ed7887b27ca55c2ee5499d58a06e2dfe1075850aabd9c54c633e","observation_id":"7e34d067-d2b7-4a47-9f7e-03fbbd7758c9","resolution":{"observed_at":"2026-08-01T21:47:02.391217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.1117","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"``What do you call a dog that is incontrovertibly true? Dogma'': Testing LLM Generalization through Humor","venue":null,"work_id":"8442d8fe-7ccf-49f0-8727-2a5510e295d7","year":2025},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.405637Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:2acad8c4a7c44c48845e255b06bc81dc14111172f09f835907cd08fd30370160","observation_id":"47c1efde-1479-4c5f-a2c1-02e593962036","resolution":{"observed_at":"2026-08-01T21:48:21.795206Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:02.433639Z","title":"and Lee, Lillian and Da, Jeff and Zellers, Rowan and Mankoff, Robert and Choi, Yejin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.433639Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:2fcde904e760c1f9c65f2ab017b37eece2ae8ce693c52092a417da02903b16f2","observation_id":"a62c85a0-2ba1-4ea2-9f02-c39b204b265c","resolution":{"observed_at":"2026-08-01T21:47:02.433639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:02.535422Z","title":"PIG uard: Prompt Injection Guardrail via Mitigating Overdefense for Free","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.535422Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:42a59e45b36cd64349f7ec3dc18747945b58ef29d911e8f6adc9c80401060ded","observation_id":"b53b31d0-2b3a-496a-9455-c5eea47bc95f","resolution":{"observed_at":"2026-08-01T21:47:02.535422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:02.618087Z","title":"Justice or Prejudice? Quantifying Biases in LLM-as-a-Judge , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.618087Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:d2654bd5283b9ff76df2d06221277fa06d2da58bca7fe9511bb0e543e74d8b0a","observation_id":"5097350a-49c0-4297-8af3-603e2da70b83","resolution":{"observed_at":"2026-08-01T21:47:02.618087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.05120","last_updated":"2026-07-06T14:07:49Z","snapshot_observed_at":"2026-08-05T18:00:12.068331Z","submitted_at":"2026-07-06T14:07:49Z","title":"Agent Data Injection Attacks are Realistic Threats to AI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05120","snapshot_observed_at":"2026-08-01T21:47:02.723794Z","title":"arXiv preprint arXiv:2607.05120 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.723794Z"},"links":{"cited_paper":"/paper/2607.05120","citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:97e980bd10aea72765d16931f9feae82d425cbd4680a993632a61b984ad324f7","observation_id":"19955a6f-658c-4b33-a1af-67c02f4b52e5","resolution":{"observed_at":"2026-08-01T21:47:02.723794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:47:02.881957Z","title":"Proceedings of the 41st International Conference on Machine Learning , articleno =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.881957Z"},"links":{"citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:3c785e5a8fd2279a78746611a026b9322e127309bf93c37a6356a1041765fc03","observation_id":"cc7a7e8f-003e-4c28-90c8-d9ad024c0548","resolution":{"observed_at":"2026-08-01T21:47:02.881957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-01T21:47:02.992276Z","title":"arXiv preprint arXiv:2307.15043 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T21:47:02.992276Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2607.15977"},"observation_digest":"sha256:35db3158100ea943ee20e2eb27962d5e2eee6da740a0580cc6924f5e531b3722","observation_id":"1bbdd3d9-0400-40a4-adf8-88faa7a8f1d2","resolution":{"observed_at":"2026-08-01T21:47:02.992276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.15977","last_updated":"2026-07-17T14:09:01Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-08T04:41:26.972393Z","submitted_at":"2026-07-17T14:09:01Z","title":"Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2607.15977."}