{"as_of":"2026-08-10T05:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:30cc772775150ebf3d7db107d2366b84bc88f48c7721e3ab85770a15a7bade13","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:05:44.625951Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T14:24:24.267269Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"cited_work":{"arxiv_id":"2507.22160","doi":"10.48550/arxiv.2507.22160","metadata_source":"pith","pith_arxiv_id":"2507.22160","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","venue":"cs.CR","work_id":"3e430440-ed08-4c9e-b10c-335c080d6bde","year":2025},"citing_paper":{"arxiv_id":"2512.20806","last_updated":"2026-05-31T13:11:43Z","snapshot_observed_at":"2026-08-06T07:38:24.259000Z","submitted_at":"2025-12-23T22:13:14Z","title":"Safety Alignment of LMs via Non-cooperative Games","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-03T14:24:24.267269Z"},"links":{"cited_paper":"/paper/2507.22160","citing_paper":"/paper/2512.20806"},"observation_digest":"sha256:fdcb097d5b22e9c81f57226daa0f60de279b6ebbcab0a54bc73bf52745f4fc0f","observation_id":"6555fb52-5a81-4d7c-a31d-47c9eba147db","resolution":{"observed_at":"2026-08-03T14:29:07.776313Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.22160/citation-record","integrity":"/paper/2507.22160/integrity","json":"/paper/2507.22160/citation-record.json","paper":"/paper/2507.22160"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.372488Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"69134f4a-dcd7-49ea-aca8-3a6750a71649","year":2022},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.425087Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:4fc086974f0df085016bd542020235323bd373598f88df013116d1183ec3f084","observation_id":"21742424-0228-49b6-b944-22f39c585070","resolution":{"observed_at":"2026-08-06T12:05:45.381035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.354835Z","title":"Deep reinforcement learning from human preferences","venue":null,"work_id":"dd30f9af-0ed5-4276-b9d0-1499ba5a0fd1","year":2017},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.433864Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:753b6193c4dd3f28a92d548c2566e061b4b216c24974dbdb4cb94f97bf91539b","observation_id":"16a914b2-ff48-422c-91e7-ace163ab7bcf","resolution":{"observed_at":"2026-08-06T12:05:45.360768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T12:05:44.442565Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.442565Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:2740763c25322786756b76ae1945aee88af5cbcee9237b38b5e94ca6dcc57634","observation_id":"dfa9d83a-feca-46da-a357-460ec701c679","resolution":{"observed_at":"2026-08-06T12:05:44.442565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:44.454732Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.454732Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:eea27b528b1d2f996f13a77bd6333daa9b195afb80d62ce9a927f1b12cd70827","observation_id":"f09ff4ca-dc03-46de-b451-fd2cba7fc169","resolution":{"observed_at":"2026-08-06T12:05:44.454732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.314975Z","title":"On large language models’ resilience to coercive interrogation","venue":null,"work_id":"3d160932-43bb-4d6a-a05d-6f8d84dff451","year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.462785Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:1c97077c972cea9a28fc679c0da0832cc37bd1d52958b048ceac830e645a02b3","observation_id":"8b56acc9-7aa6-4136-ba2a-9940a912e427","resolution":{"observed_at":"2026-08-06T12:05:45.320699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T12:05:44.471626Z","title":"Universal and transferable adversarial attacks on aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.471626Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:375f1ea09f6e3cabc3c3583e6e015425a2ed9da5846a290230a7655b226d607a","observation_id":"6ab8a4e0-999b-4b93-a1ca-820f02528e21","resolution":{"observed_at":"2026-08-06T12:05:44.471626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.289797Z","title":"Jailbreak open-sourced large language models via enforced decoding","venue":null,"work_id":"604cd6d5-74a8-45e1-9d22-50d14a167ba3","year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.477735Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:c68eda32f6fb925df186a3898173f09528c53b19c7d6faccdb775a96179f6818","observation_id":"5d7d4768-5c38-442e-900d-7453e798e9ea","resolution":{"observed_at":"2026-08-06T12:05:45.297838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.269673Z","title":"Safety alignment should be made more than just a few tokens deep","venue":null,"work_id":"4ee50f5a-56bb-46f8-bccd-3a7c1d89e737","year":2025},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.486012Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:030912c04e4e4e8ef42253a53189dc5a4c01e1eac2ca8d9e91e17d5d6678cdc7","observation_id":"99440afc-c6b0-4c6b-9eb2-c10f3cdb3c0e","resolution":{"observed_at":"2026-08-06T12:05:45.275737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.243427Z","title":"Jailbroken: How does llm safety training fail? In Advances in Neural Information Processing Systems , volume 36, pages 80079–80110, 2023","venue":null,"work_id":"c82e7e2e-f233-4e4a-9160-c92e31cd05e2","year":2023},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.491524Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:a675bad7106c846ce0ef01ee69879e069ee8abe6922bdc629a936698bc285eaf","observation_id":"180b2f18-aaf7-4ad0-86ef-3d9682ca6f8c","resolution":{"observed_at":"2026-08-06T12:05:45.251296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.209170Z","title":"do anything now","venue":null,"work_id":"382b0480-afb1-4789-8892-e8165f921219","year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.498317Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:c87c921c4d82be6d43b69fc33a1885b25c1f3c6ead4fedca42318a4d78fcf8e3","observation_id":"e838db4e-e370-4e8c-b125-56c08475e087","resolution":{"observed_at":"2026-08-06T12:05:45.216533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16765","last_updated":"2024-01-30T06:04:04Z","snapshot_observed_at":"2026-08-06T05:07:17.837298Z","submitted_at":"2024-01-30T06:04:04Z","title":"A Cross-Language Investigation into Jailbreak Attacks in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16765","snapshot_observed_at":"2026-08-06T12:05:44.503676Z","title":"A cross-language investigation into jailbreak attacks in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.503676Z"},"links":{"cited_paper":"/paper/2401.16765","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:731729ad1e52783a2403c0538febb41ba780f67f087dfef0a8127d4720c88955","observation_id":"4fd0b2e3-1ba8-43d1-9d0e-8a75fcc6e530","resolution":{"observed_at":"2026-08-06T12:05:44.503676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.184744Z","title":"Protecting your llms with information bottleneck","venue":null,"work_id":"c23da415-5f19-45d2-a533-c1bf83d860ff","year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.509524Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:f48f6529555e1f354edb068942f91249632d3993b40481dd5bfef791e36d42a9","observation_id":"6b12d06e-437a-4d7b-9924-6203a60c4777","resolution":{"observed_at":"2026-08-06T12:05:45.192046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T12:05:44.514125Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.514125Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:9d2f62a42cac1695968d411a758f98ae573f8d3d1aff549ab9601984f3325ea9","observation_id":"959e6f3d-fa51-4b4f-ab98-39129bcc81b5","resolution":{"observed_at":"2026-08-06T12:05:44.514125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.162310Z","title":"Jailbreaking black box large language models in twenty queries","venue":null,"work_id":"72f2ead8-58ba-4427-8880-dd4f5d5f9cb0","year":2025},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.520627Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:1138bb2036b168d89a6e0c25db8f766dffd9387b67264944e63a51ebb633b94d","observation_id":"7f96471a-2d22-4819-acaf-8b43d1aebc20","resolution":{"observed_at":"2026-08-06T12:05:45.169706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.136976Z","title":"Fuzzllm: A novel and universal fuzzing framework for proactively discovering jailbreak vulnerabilities in large language models","venue":null,"work_id":"28a20da7-3195-4803-aeb7-e9db55de1291","year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.526173Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:94bd835ba8cb5570feb7bd9259fcdf0f423f6b9760a6b78da255b50673c8ede0","observation_id":"ec7747ca-aa95-40b9-829b-cb04fb8f2627","resolution":{"observed_at":"2026-08-06T12:05:45.145466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.112493Z","title":"Catastrophic jailbreak of open-source LLMs via exploiting generation","venue":null,"work_id":"9b4e092e-bc3a-4080-af80-e3f4fca7f115","year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.531779Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:c0473474d89f73fccae222479cd363e4bafe54c292ea40c34ed26639a1a7f8af","observation_id":"df81673c-0842-46ba-859d-37721d4b7f7d","resolution":{"observed_at":"2026-08-06T12:05:45.120803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-06T12:05:44.536146Z","title":"Baseline defenses for adversarial attacks against aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.536146Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:0323327f93a3024a143662b8c756b42d91a37bbb4ddb5f7ba938b5826a29fead","observation_id":"3c873539-fcdf-4f0e-ac3e-142987dd9777","resolution":{"observed_at":"2026-08-06T12:05:44.536146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02705","last_updated":"2025-02-04T19:47:09Z","snapshot_observed_at":"2026-07-06T16:15:00.517258Z","submitted_at":"2023-09-06T04:37:20Z","title":"Certifying LLM Safety against Adversarial Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02705","snapshot_observed_at":"2026-08-06T12:05:44.541606Z","title":"Certifying llm safety against adversarial prompting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.541606Z"},"links":{"cited_paper":"/paper/2309.02705","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:28fce00782edc3f7fe25ab4736f4610bd5bf6e2db21a1ea382ce7f5212636dd8","observation_id":"15f793b9-b949-4dce-9e30-e3e82aa31e24","resolution":{"observed_at":"2026-08-06T12:05:44.541606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14132","last_updated":"2023-11-07T03:30:15Z","snapshot_observed_at":"2026-07-06T16:10:54.723336Z","submitted_at":"2023-08-27T15:20:06Z","title":"Detecting Language Model Attacks with Perplexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14132","snapshot_observed_at":"2026-08-06T12:05:44.546775Z","title":"Detecting language model attacks with perplexity","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.546775Z"},"links":{"cited_paper":"/paper/2308.14132","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:72680e9db4b04c1932429da94a36beb7f1d51512277219acb0512cd2f4e03b32","observation_id":"fb9a6b82-8580-41da-95fa-7ed979b2a608","resolution":{"observed_at":"2026-08-06T12:05:44.546775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05206","last_updated":"2026-04-14T16:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-02T05:14:22Z","title":"Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05206","snapshot_observed_at":"2026-08-06T12:05:44.552474Z","title":"Safety at scale: A comprehensive survey of large model safety","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.552474Z"},"links":{"cited_paper":"/paper/2502.05206","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:8d9788740a0e2256418c4b58b25178d08408b6d002acd5c15ee1414d671efb17","observation_id":"7f9a2905-5fa5-454b-8b4f-e8392af0d7b5","resolution":{"observed_at":"2026-08-06T12:05:44.552474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.090716Z","title":"Robust safety classifier against jailbreaking attacks: Adversarial prompt shield","venue":null,"work_id":"9c3190a3-a179-4d01-9975-dbef75331016","year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.558156Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:5c9ae60f854f01290183cfa8b841f8409f820055af76a19f2a9e9b3491ea1385","observation_id":"5f17508b-2095-457f-8ce1-88baba66d487","resolution":{"observed_at":"2026-08-06T12:05:45.097945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.072639Z","title":"Jailbreaking leading safety-aligned LLMs with simple adaptive attacks","venue":null,"work_id":"dc90e9ab-a983-49e7-9f36-0c1275833ea6","year":2025},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.562678Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:ae0b26a775503cc96abadd7a15e4429edc35468fbf63f68927e90e63a1069035","observation_id":"cf1f2e26-6ed2-4ed9-ae91-db14b03b78ea","resolution":{"observed_at":"2026-08-06T12:05:45.078524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.052671Z","title":"Contrastive preference optimization: pushing the boundaries of llm performance in machine translation","venue":null,"work_id":"43fb68d1-7672-40f2-8529-540bca5008b6","year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.567565Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:542e6344d37e1e4bf86456959243a80128e99b4b8cb2d9588e1f6131583de930","observation_id":"96d42cbc-56fc-4e49-9716-d763f85de590","resolution":{"observed_at":"2026-08-06T12:05:45.058799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.033572Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"e798cf5a-1c88-430e-9b26-406b66af0397","year":2023},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.573509Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:cca32352f1dc6a33db82dd81afd0275d2aead27d89268ecdd2e346d3cb315cf5","observation_id":"5a10df76-0587-463d-ae29-e55144495ca9","resolution":{"observed_at":"2026-08-06T12:05:45.038739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T12:05:44.578742Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.578742Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:dab6bed45cd9e4b564e2ac099a714c009af1d828eb887aad459d238244430662","observation_id":"30688163-6060-4951-9142-cd1519a81b63","resolution":{"observed_at":"2026-08-06T12:05:44.578742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:45.013760Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"112ac4ea-240f-4b99-b0d0-789908cd5f6e","year":2022},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.583833Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:9a3e53d776c0cbf2b2057396af5bbee1fdff5cb96054f42871d4940bff976e07","observation_id":"0ccbce3f-2f9f-4247-abac-6a0be005e2f2","resolution":{"observed_at":"2026-08-06T12:05:45.019654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:44.589072Z","title":"Trl: Transformer reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.589072Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:f5423600bf3449bf8d672fd1ad42ae9dc98e9468b213e3195985594ded4b0e59","observation_id":"bc351a75-c6fb-427e-acbc-49c9ac3f7208","resolution":{"observed_at":"2026-08-06T12:05:44.589072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-06T12:05:44.597243Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodality, long context, and next generation agentic capabilities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.597243Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:7494f76383044c191b9f05d2b3db4af0c5cbc9741a07daff5d40c4d61f1c1f68","observation_id":"873c020d-26d4-407f-8a25-49f083c58d78","resolution":{"observed_at":"2026-08-06T12:05:44.597243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:44.979567Z","title":"tinybench- marks: evaluating llms with fewer examples","venue":null,"work_id":"9203b3de-49bc-4deb-a392-cd3e88fec141","year":2024},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.603212Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:4c653aaecaad8187c85426259a9fe90079da39da269798add9aa1aa35859cd58","observation_id":"0ae32380-0592-472e-9f90-fdee11c65965","resolution":{"observed_at":"2026-08-06T12:05:44.987019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:44.961491Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":"be4c124c-e02a-471b-a2c9-f5ee750fac0b","year":2021},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.608545Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:03f9744bc4a5001284d799a7f7b889c89c2fdafbe6f3edf730a92d73e55f97af","observation_id":"7681c4da-35cc-4c17-88e6-1bca9d12be53","resolution":{"observed_at":"2026-08-06T12:05:44.966908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:44.942077Z","title":"Hellaswag: Can a machine really finish your sentence? In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics , pages 4791–4800, 2019","venue":null,"work_id":"3c4074f3-f8cb-4b26-84ca-677302d38e3d","year":2019},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.614731Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:d043ff9b5de1c6212425261a741316684ac3376f4a5cd446e69c755286183432","observation_id":"f5ba09d9-18eb-47c9-8748-12d938f62721","resolution":{"observed_at":"2026-08-06T12:05:44.948768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:05:44.920967Z","title":"Truthfulqa: Measuring how models mimic human falsehoods","venue":null,"work_id":"7ff1eaac-a95b-4cb2-bc50-19a861b490b6","year":2022},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.620968Z"},"links":{"citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:56aeb56ac4516a53ea5e8ef392b2c35b615b1945b8ec18b7bb7f4c4ff4ff7303","observation_id":"e1449f35-7554-4725-8fee-7f70f47afc52","resolution":{"observed_at":"2026-08-06T12:05:44.928307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T12:05:44.625951Z","title":"I”, “am”, “AI","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T12:05:44.625951Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.22160"},"observation_digest":"sha256:2ceaf9ea7cd02b2d6b94cab610c94eefef876a9fe8ed521deeac78a67a872cec","observation_id":"a8c10808-bfa8-4ae3-b582-4d13098932b0","resolution":{"observed_at":"2026-08-06T12:05:44.625951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.22160","last_updated":"2025-07-29T18:46:56Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-08T12:07:49.961454Z","submitted_at":"2025-07-29T18:46:56Z","title":"Strategic Deflection: Defending LLMs from Logit Manipulation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2507.22160."}