{"as_of":"2026-08-10T07:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2186326c98c036732b38886fa8273bee888ab23b33f94c75605f2035a5d97ff","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:01:11.293318Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:13:18.236329Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T12:10:06.551163Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-08-07T14:13:18.236329Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:18.236329Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:93427af9c5eb84331d5b6f9e1f19e385934c9f18f4c98c714af9359ead522482","observation_id":"99d12c4e-3487-457b-a724-e76e87749422","resolution":{"observed_at":"2026-08-07T14:13:18.236329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-08-06T23:33:38.666517Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17209","last_updated":"2025-06-20T17:57:12Z","snapshot_observed_at":"2026-08-08T06:00:05.474887Z","submitted_at":"2025-06-20T17:57:12Z","title":"Fine-Tuning Lowers Safety and Disrupts Evaluation Consistency","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:33:38.666517Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2506.17209"},"observation_digest":"sha256:bd2acd9ee9df564bc6fcb6b7b09df58e287e60240481c5b1fe8f62fef5766f3b","observation_id":"87835160-6169-4bad-85ab-42d70d58e263","resolution":{"observed_at":"2026-08-06T23:33:38.666517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-08-05T14:51:03.622906Z","title":"Are smarter llms safer? exploring safety- reasoning trade-offs in prompting and fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20848","last_updated":"2025-08-28T14:40:27Z","snapshot_observed_at":"2026-08-09T22:07:47.609622Z","submitted_at":"2025-08-28T14:40:27Z","title":"JADES: A Universal Framework for Jailbreak Assessment via Decompositional Scoring","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T14:51:03.622906Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2508.20848"},"observation_digest":"sha256:61d04db3121f4cebc197595afaabe400856ad5763e23388f3f41c1a689f35377","observation_id":"f86bbfdc-109e-464b-9a01-fb34afe264e4","resolution":{"observed_at":"2026-08-05T14:51:03.622906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-08-05T10:39:05.951962Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-08T03:54:26.940042Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:05.951962Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:cd2979192e613133928f9941a2cb0faa5077d5e29289e875d8da989a2fe29918","observation_id":"2b9a9c36-32bc-4586-aba2-f7637ba6a9f4","resolution":{"observed_at":"2026-08-05T10:39:05.951962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2502.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Are Smarter LLMs Safer? Exploring Safety- Reasoning Trade-offs in Prompting and Fine-Tuning.CoRR abs/2502.09673","venue":null,"work_id":"87390412-811f-482c-998b-04197e99da8f","year":2025},"citing_paper":{"arxiv_id":"2510.21285","last_updated":"2026-04-24T07:43:03Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T09:32:25Z","title":"When Models Outthink Their Safety: Unveiling and Mitigating Self-Jailbreak in Large Reasoning Models","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T05:02:52.176629Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2510.21285"},"observation_digest":"sha256:91b2267b403047260b4d22bc9143d6bdebcb07e6c7a9eb922f8cfa5da7d35a05","observation_id":"2abb3a56-a65b-46f2-93fa-e738d6203397","resolution":{"observed_at":"2026-05-18T05:05:55.652539Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-08-04T06:54:10.609590Z","title":"Are smarter LLMs safer? exploring safety-reasoning trade-offs in prompting and fine-tuning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.00382","last_updated":"2026-08-03T16:22:30Z","snapshot_observed_at":"2026-08-07T22:27:02.267336Z","submitted_at":"2025-11-01T03:29:56Z","title":"Efficiency vs. Alignment: Investigating Safety and Fairness Risks in Parameter-Efficient Fine-Tuning of LLMs","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T06:54:10.609590Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2511.00382"},"observation_digest":"sha256:43ae0460a42a326aae1f6b5af51ec68d24ccbcfbe8ad45a550666529a12263c9","observation_id":"d97ad282-8b47-418c-a39b-0dc35abba7e4","resolution":{"observed_at":"2026-08-04T06:54:10.609590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2502.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Are Smarter LLMs Safer? Exploring Safety- Reasoning Trade-offs in Prompting and Fine-Tuning.CoRR abs/2502.09673","venue":null,"work_id":"87390412-811f-482c-998b-04197e99da8f","year":2025},"citing_paper":{"arxiv_id":"2603.04459","last_updated":"2026-05-14T18:30:07Z","snapshot_observed_at":"2026-07-06T22:47:50.848191Z","submitted_at":"2026-03-03T09:10:45Z","title":"Benchmark of Benchmarks: Unpacking Influence and Code Repository Quality in LLM Safety Benchmarks","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-21T12:09:55.500940Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2603.04459"},"observation_digest":"sha256:5b22463529dc2d6902dd280ed92567ecc0c6aeae5be2c6eb3a2b9abb7a5209b5","observation_id":"d4f4a15e-e71c-4603-93d4-17c5c6af3422","resolution":{"observed_at":"2026-05-21T12:10:06.554468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2502.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09673","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Are Smarter LLMs Safer? Exploring Safety- Reasoning Trade-offs in Prompting and Fine-Tuning.CoRR abs/2502.09673","venue":null,"work_id":"87390412-811f-482c-998b-04197e99da8f","year":2025},"citing_paper":{"arxiv_id":"2605.15239","last_updated":"2026-05-14T03:40:07Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T03:40:07Z","title":"Reducing the Safety Tax in LLM Safety Alignment with On-Policy Self-Distillation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-19T16:34:47.856606Z"},"links":{"cited_paper":"/paper/2502.09673","citing_paper":"/paper/2605.15239"},"observation_digest":"sha256:c4eb3659a752fd9bf249b4f77bf7b43df68540c4b68c03a5399b12ba493624f1","observation_id":"e3658083-daf6-45fe-875e-33ddb4234433","resolution":{"observed_at":"2026-05-19T16:37:39.908935Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09673/citation-record","integrity":"/paper/2502.09673/integrity","json":"/paper/2502.09673/citation-record.json","paper":"/paper/2502.09673"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:10.957663Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:10.957663Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:8d5c595807c02d0ba05d5e714e59a660782df10688ac8f5ce3811e209eaf0c30","observation_id":"fff99562-0f27-4344-b3a1-3e26a710bcdb","resolution":{"observed_at":"2026-08-07T23:01:10.957663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.384524Z","title":"Bowman, Ethan Perez, Roger Baker Grosse, and David Duvenaud","venue":null,"work_id":"35bfe970-fb6e-48ec-bdb0-020ffd6183f0","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:10.964236Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:c908ce1c59cecceffb2ea0d85b7dd4885cf76d6b9c67d9c12e2d9f2a918b9bba","observation_id":"df73dbb4-34d2-4f7d-b6bd-c48ec90448be","resolution":{"observed_at":"2026-08-07T23:01:12.389921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:10.969297Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:10.969297Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:128a5c52091c19d5ae516697ecc4baaefd48afec3be228658776c6a84773a9a9","observation_id":"0aa15d88-d317-4d76-8fbb-d80ad28c64f8","resolution":{"observed_at":"2026-08-07T23:01:10.969297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:10.974686Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:10.974686Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:965db9a2b7fe9829b095c3fa2e2c02cbf199f154644529335b147f259e4e433b","observation_id":"c17e2da3-fadc-4134-a894-84a4c04b3d1b","resolution":{"observed_at":"2026-08-07T23:01:10.974686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.345186Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"0ce2aa28-214c-46a4-bf76-e85852728ece","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:10.979716Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:f70c5d33c9b767db135ad129645488613107ddcc45bea0b6c8b2ff8c1c4f184b","observation_id":"972fcc9f-75dc-42ff-884b-ae2c15ae977a","resolution":{"observed_at":"2026-08-07T23:01:12.350917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.329849Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":"10e3e6be-87e1-4d29-989f-b3f60759f5af","year":2021},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:10.984697Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:9006bfe61c0ebddbe7f856e4c136b7ae15dfe66dc8acd29e910768ad350a77ad","observation_id":"b4ea5d79-5dce-48f1-8cd4-e2aa3a9e1651","resolution":{"observed_at":"2026-08-07T23:01:12.334733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.314206Z","title":null,"venue":null,"work_id":"23f9cb66-8853-4dec-8555-39bef9f08b78","year":2025},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:10.990667Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:336f8ceb5943a0b5b4a6554c95c5ff829cdc27d6266d3f492c039f0576aacd0f","observation_id":"eb822c5d-dd69-4652-8eaf-ef9333fb05ee","resolution":{"observed_at":"2026-08-07T23:01:12.319215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.297728Z","title":"The llama 3 herd of models","venue":null,"work_id":"51dfd4fe-54d5-4c59-9d72-cca8e8520340","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:10.996443Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:9e09dbbee954b11a700afd96d1362203946558046d0ac95480fd7569c6e95dc8","observation_id":"36bb8e0d-463e-483b-976c-203963346759","resolution":{"observed_at":"2026-08-07T23:01:12.303453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.280305Z","title":"Reasoning about knowledge","venue":null,"work_id":"7f94f2c4-81ea-43be-970c-fd30d3d0cf29","year":2004},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.001525Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:ddd97a999bd6c6c4d1420a10506f5ca260ef76daa4bc509cc0cecc904789665f","observation_id":"ba75bb65-19b3-4569-8293-29a6a7ea0e81","resolution":{"observed_at":"2026-08-07T23:01:12.285927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.006417Z","title":"Statistics (international student edition)","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.006417Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:03c254b5397d5457a1ee48721fc3b5068c1c8e547bac5aae8658b43366a50243","observation_id":"436441ac-2d0a-4f4c-864a-0b2f3dc14c87","resolution":{"observed_at":"2026-08-07T23:01:11.006417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.253362Z","title":"Approaches to studying formal and everyday reasoning","venue":null,"work_id":"6eff30df-3298-47cb-a01a-947dcf7b6ff0","year":1989},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.011225Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:37cab06c3289be1da4d7aee7edad90a24c73834334c4aadaddcaf48196164c5c","observation_id":"26c95033-2f23-4c12-897d-26ae9a40aefb","resolution":{"observed_at":"2026-08-07T23:01:12.258456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.237827Z","title":"Omni-math: A universal olympiad level mathematic benchmark for large language models","venue":null,"work_id":"d7150f4d-9689-469f-a3c6-97ca89d19bcc","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.016280Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:252eb1559fb1cf5250a42fc9d0348ba49cabec2e73c2470b4506637eb35cbf0c","observation_id":"27150749-7e7a-42c8-a239-0f516b846632","resolution":{"observed_at":"2026-08-07T23:01:12.242918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.222549Z","title":"Bias runs deep: Implicit reasoning biases in persona-assigned LLM s","venue":null,"work_id":"f6dcfe6e-45b0-4ffd-a04e-1192aceb70c9","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.021016Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:043648dfb927530b2f071a54fce71e32ee8b761b4bf98135e6e2b2f65e19c2e5","observation_id":"b50d33a1-b37e-4b45-8e57-30d520199e49","resolution":{"observed_at":"2026-08-07T23:01:12.227619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.206510Z","title":"In-context learning may not elicit trustworthy reasoning: A-not- B errors in pretrained language models","venue":null,"work_id":"80ab26a5-b74f-4a88-aaf4-c8e806808ba5","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.025659Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:a1b8b3483d6e354f2ec6f55255cecc193777c95447174958008aa1c77e8bae7c","observation_id":"18b7d01f-b1cf-433d-97f4-9ce34229855d","resolution":{"observed_at":"2026-08-07T23:01:12.211645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.190362Z","title":"Multi-modal latent space learning for chain-of-thought reasoning in language models","venue":null,"work_id":"e384c124-e2d5-4c7d-b005-53f8cd97c5c1","year":2025},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.030145Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:4253c9026f1a887f6f0c5e76f54c4b3ecae8bcf57cd68ae2887105052ec54c44","observation_id":"15b50fcf-c829-4d0c-b684-8950c1858a2a","resolution":{"observed_at":"2026-08-07T23:01:12.195466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.174023Z","title":"What is in your safe data? identifying benign data that breaks safety","venue":null,"work_id":"0b713ecf-e16d-4c20-94a8-270b63819217","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.034951Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:9bff2162f5ba93f7c206c4221efc943d57df44f085c5c318218518b729a81296","observation_id":"f525ec62-9893-421b-8465-49fc36cc7121","resolution":{"observed_at":"2026-08-07T23:01:12.179065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.157872Z","title":"Large language models cannot self-correct reasoning yet","venue":null,"work_id":"7b512fd7-f976-4b8e-8a70-70d1e9eb9518","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.039925Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:c1f5fa51649bc6cfdbe3d8bb4288d112525e99f72b1a63f70a0b13bf3ed668f3","observation_id":"2ef52e94-b6b2-41be-99ae-ba90af6d92d0","resolution":{"observed_at":"2026-08-07T23:01:12.163584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.141387Z","title":"Trustllm: Trustworthiness in large language models","venue":null,"work_id":"76334bbb-6ea1-4556-bd73-c74bae8b814e","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.044647Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:c122fe3b5f63d1d3e9559513085b8a08bcd546aae09b0917d85f743c27d66ae9","observation_id":"bd530628-18d0-4f64-a54f-fd31b58c88db","resolution":{"observed_at":"2026-08-07T23:01:12.146897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.125356Z","title":"Alpaca-python-18k","venue":null,"work_id":"c8fa4015-4513-44de-ae8f-7172b2ef2dfb","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.049362Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:58cedd96c9bef4e54edf07043849c52e8b172f912145912fcb0cd14ff28b82ca","observation_id":"e55257db-f81c-4f89-ab6f-cab69b82c4ef","resolution":{"observed_at":"2026-08-07T23:01:12.130511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.109576Z","title":"Openai o1 system card","venue":null,"work_id":"903d347c-2dc8-42f7-99db-03ab1edec16c","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.054681Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:e791e7dedb6f69dc158db9855c9be630a2a4cc0df65105deeea6cd07d55687cc","observation_id":"521cca33-80f2-484a-8d68-be521604dabb","resolution":{"observed_at":"2026-08-07T23:01:12.114630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.091932Z","title":"Multitask-bench: Unveiling and mitigating safety gaps in LLM s fine-tuning","venue":null,"work_id":"f7d665e3-1764-403d-b88d-2928a02c1957","year":2025},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.059223Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:4effdcf2b6ffe7eba1c8a08bcadf72d4edcb1e80861b9e01ab4cb12e616d3350","observation_id":"e6de7a57-1f89-4103-8d2e-d7c402c875ec","resolution":{"observed_at":"2026-08-07T23:01:12.097607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.074686Z","title":"Mistral 7b","venue":null,"work_id":"f151ab0a-f6c3-411b-ba49-254e7e26ef17","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.066092Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:30a3465b1b6fea0b3232f235d683b2a5df5908d372c1bcd818cd271780a2d065","observation_id":"40e0370f-1043-4f39-977d-205f6974e1ca","resolution":{"observed_at":"2026-08-07T23:01:12.080410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.057706Z","title":"Enhancing question answering for enterprise knowledge bases using large language models","venue":null,"work_id":"e6704885-6ec6-405c-b266-80b2a1140fbd","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.071050Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:045f29242f72ea37fb99386ea0984ebb052d32ed88e50c5be59d921bcc4037f7","observation_id":"358acf5e-0142-41dc-a40e-63c9b9c4cdc6","resolution":{"observed_at":"2026-08-07T23:01:12.063018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.075956Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.075956Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:ae087a1263e4f0c6ed4c88a7a8ffbd0003bff49acb3ee73e58030976733206d3","observation_id":"3a3ee318-204b-455d-8cd0-29896e1a06ce","resolution":{"observed_at":"2026-08-07T23:01:11.075956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.081307Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.081307Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:5e177e98e6b4c0cefcde08e65b0297acc499c35c9c63a40d9724db8f35bfbf21","observation_id":"715caee6-c28c-41ea-a140-9ac0b4ef0cf0","resolution":{"observed_at":"2026-08-07T23:01:11.081307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.021920Z","title":"Deceptive semantic shortcuts on reasoning chains: How far can models go without hallucination? In NAACL, 2024 a","venue":null,"work_id":"9b3c23a7-24d5-4fcc-a993-d0c41afb5734","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.086427Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:f6b38346cacc4410ec02a3a2a460c4f667ec525d3a422494d973165034199dc7","observation_id":"64e75eb9-f67d-4bee-95fe-0bb746a86d24","resolution":{"observed_at":"2026-08-07T23:01:12.027201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:12.005792Z","title":"D r A ttack: Prompt decomposition and reconstruction makes powerful LLM s jailbreakers","venue":null,"work_id":"921140bf-b191-4155-8a26-9f1e1fa50088","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.091164Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:f56b72ec7b12e852c4990e037952ae098a23846f333ea6a787b5a0972080c19d","observation_id":"f1b9ef1e-fa4f-4d62-90d6-8f30ad05c4c8","resolution":{"observed_at":"2026-08-07T23:01:12.011297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.988468Z","title":"Retrieval-augmented multi-modal chain-of-thoughts reasoning for large language models","venue":null,"work_id":"b5108207-7202-49e3-8e70-a2e61ae6b968","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.096657Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:096c981bf4debb3cb18434774394530a3693a4b71d3271ae12938edf955bedd6","observation_id":"d6fdb0b1-5991-4158-ad32-b0c951799934","resolution":{"observed_at":"2026-08-07T23:01:11.994149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.972848Z","title":"Intelligence and reasoning","venue":null,"work_id":"12c47064-b0e6-4b73-a511-76d7fc940194","year":2011},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.101412Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:ae72b3669e1ccae20390adfb62f58a23c7cd49f9d78f3f699f60c773018f7c4d","observation_id":"581f9df0-833e-4ed8-a93b-e3f807811c28","resolution":{"observed_at":"2026-08-07T23:01:11.977917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.957925Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":"73daa9c9-e0ea-4f13-8d2a-939488481a2a","year":2022},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.105917Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:b761328d6db382256ec46e3c1e9e2224faf7dea7c66c0efe1d78ad0a8b436713","observation_id":"ffc2a88d-8656-433b-b2d8-d87ba8f646be","resolution":{"observed_at":"2026-08-07T23:01:11.963197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.941823Z","title":"Keeping LLM s aligned after fine-tuning: The crucial role of prompt templates","venue":null,"work_id":"5773ea11-15fe-4d6d-9f55-8fc661abc397","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.110676Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:25dbf508996596ab26c2290d7ec34a2b8e17773377c7f7e8356ef513385717ba","observation_id":"adb5a056-57ef-4ec1-82ea-083af7717943","resolution":{"observed_at":"2026-08-07T23:01:11.947060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.926008Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":"1a256ba1-1dfe-48ed-8318-e3538ca928f8","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.115071Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:fe8e2e0957672e6f427afeffc532dd07472aa91e1509cd2046c33658a9919230","observation_id":"f5594f7b-3b8a-4d03-99f4-8d2bffce7b41","resolution":{"observed_at":"2026-08-07T23:01:11.931393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.910601Z","title":"What is reasoning? Mind, 127 0 (505): 0 167--196, 2018","venue":null,"work_id":"d7f2dc75-12a2-44bd-b5d1-dd06c89bea02","year":2018},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.119860Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:3d6f0e8b73f4c0e9b4cc61b95ccd1415bdfe0c51debed4c1a041e16c8547f080","observation_id":"6f918837-db4e-44e1-9c29-83410bc57050","resolution":{"observed_at":"2026-08-07T23:01:11.915770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.895341Z","title":"Sky-t1: Train your own o1 preview model within \\ 450","venue":null,"work_id":"4cc5e381-ba49-49a4-8409-fc1764f93833","year":2025},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.124823Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:f6f69b24d0d940dcb3bf279959bd2c7c9569ecf823dc2636c62934d8f277b810","observation_id":"bb7116ab-2d3d-41d8-980b-7dde6ec959ff","resolution":{"observed_at":"2026-08-07T23:01:11.900634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.878742Z","title":"O1-open/openo1-sft","venue":null,"work_id":"8dbe86ed-70fa-4627-b801-a485db849865","year":2025},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.129868Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:8595b5e4c9c02c802a45c3c08e618a3bcc1be0e31b4040b5fdbc0ff9a11633a0","observation_id":"c3ec33f3-e7b7-46d2-9c85-318d7210b7a5","resolution":{"observed_at":"2026-08-07T23:01:11.883930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.862283Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":null,"work_id":"f7e229a1-de34-4826-9163-1d5bd36830d2","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.134957Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:21bb5c52832494b8a701ba79b5538aa57e893221f252863f7a4abd66721149a8","observation_id":"8e69cc11-be9a-4ed6-944c-198624e03088","resolution":{"observed_at":"2026-08-07T23:01:11.867818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.845260Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to! In ICLR, 2024","venue":null,"work_id":"50bc8f42-b9c4-4bb2-be07-5ca11c60b509","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.139541Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:2ddb828e58748a678420734efa9982eaae5aeec27cdbb7cffdf94f0ff5b561ae","observation_id":"440a79e3-27b9-4b03-87a5-8aba601d620b","resolution":{"observed_at":"2026-08-07T23:01:11.850769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.829171Z","title":null,"venue":null,"work_id":"091cdcf9-4bf6-4809-8638-0531e1640587","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.145092Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:9e19779761a8f6d64b3846c85ada528bcd784890625aee81ae6fda364acca139","observation_id":"8d473a88-80ae-487f-b63a-2b5b05388256","resolution":{"observed_at":"2026-08-07T23:01:11.834441Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.811730Z","title":"On second thought, let`s not think step by step! bias and toxicity in zero-shot reasoning","venue":null,"work_id":"a9d611bd-1aa7-44ca-9f1f-bfcf1ae762ad","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.149579Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:c04f2749724baec8ddc92248107f6ed32ec659b5009affe1f2ee02d3613c7e3e","observation_id":"7b043813-44e0-4f88-b35c-0c8f05103457","resolution":{"observed_at":"2026-08-07T23:01:11.817449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-07T23:01:11.154193Z","title":"Reflexion: an autonomous agent with dynamic memory and self-reflection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.154193Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:e9ff1340d2b207736452fdeed030c38f9d92b14068d97f2d7c4b688963cca294","observation_id":"147ddff0-cceb-456b-9f82-95d2635129ed","resolution":{"observed_at":"2026-08-07T23:01:11.154193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.794828Z","title":"Automatic prompt augmentation and selection with chain-of-thought from labeled data","venue":null,"work_id":"3d861067-9a5d-46a1-99b9-dc8a362bfa2c","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.159871Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:acbb17a1db371d78fab557ff60d485c7ec18a880d5f2f2e08ca657b0add3226a","observation_id":"92f4db3c-2484-4fef-aa7c-57f5378f3834","resolution":{"observed_at":"2026-08-07T23:01:11.800869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.777938Z","title":"mattshumer/reflection-llama-3.1-70b","venue":null,"work_id":"3b040c47-b70a-4844-b77b-956c3f1b1895","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.164514Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:063c3079c3aba415b3dc50f88730d0ca2e425a1df17fd9a4d82180766e515724","observation_id":"bbdcf156-542d-42b6-b03e-972c79568880","resolution":{"observed_at":"2026-08-07T23:01:11.783203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.758938Z","title":"Barr, and Wei Le","venue":null,"work_id":"e326fba0-1e89-4726-aeed-833ba3e3e85e","year":2025},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.169123Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:599f238b302cda39379b59eafdabc1f6a654abb8c50f81ba5184d5cabfe7e7e2","observation_id":"10fedef2-73ed-4aa8-9581-0bb48cd9e1c1","resolution":{"observed_at":"2026-08-07T23:01:11.766079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.742364Z","title":"Story centaur: Large language model few shot learning as a creative writing tool","venue":null,"work_id":"90266379-95e9-45c8-8287-6535a87aa2a0","year":2021},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.174370Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:0f574dd8c10890a40de075a638f9011cbf935073304b4e2b7dc8472d9df55512","observation_id":"6fbf16db-1459-4e91-9e8a-f316e26837b8","resolution":{"observed_at":"2026-08-07T23:01:11.747901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.726202Z","title":"Hashimoto","venue":null,"work_id":"2a1f6ec4-f914-430c-87ed-a7cfb2dbf8a1","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.179512Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:ccf05585a88ade9a153f17479aefb4cb07e0ced845ab0d9d109a0a6c92271dd2","observation_id":"98dfcd0d-985a-48f8-86ff-8cafa99f3801","resolution":{"observed_at":"2026-08-07T23:01:11.731168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.710329Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":"a87537e1-b8ef-4a0e-bd29-7a3e2b4222a5","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.184376Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:815dc6ed217d2e36e44404b0821e1f3009c40e4897e13a42048184ccf2a1201d","observation_id":"7b5f92c6-08f1-4daf-865e-86a68a676067","resolution":{"observed_at":"2026-08-07T23:01:11.715718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.694193Z","title":"Rush, and Thomas Wolf","venue":null,"work_id":"75ac8752-3c45-4429-b486-2c4507ccc3a5","year":null},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.189131Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:f3b196a4deeeb00e7128d149c630e3c6b900482578b17e5c42fac5417546e1f5","observation_id":"d62fb00f-d054-4691-8c9d-95ca49c78981","resolution":{"observed_at":"2026-08-07T23:01:11.699643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.194130Z","title":"Decodingtrust: A comprehensive assessment of trustworthiness in gpt models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.194130Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:35eaf5e413cc403013b3574342f2be9e672dfa375bf9ebbeca50b0b34c7afad3","observation_id":"2b2eb7e4-60ac-4eae-9090-8dee198d1120","resolution":{"observed_at":"2026-08-07T23:01:11.194130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.668524Z","title":"Drt-o1: Optimized deep reasoning translation via long chain-of-thought","venue":null,"work_id":"00cde2b6-1eab-464e-8ab0-a20563d2b288","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.198773Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:a6933a1e4502cdc18a31ac44ea0f7e4142f21a7a05204c9ff2565dc20334ca65","observation_id":"0800f9c0-ec75-4cfd-9026-79abb19aaa85","resolution":{"observed_at":"2026-08-07T23:01:11.673803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.652073Z","title":"Openr: An open source framework for advanced reasoning with large language models","venue":null,"work_id":"66e262ae-88a5-4166-b67b-ddc840f7e094","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.203917Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:421bb66c2e9150054fdcd92cb02b1f7f4e4dbd5b1047457f5b55a2bc79f073d9","observation_id":"8ae4293c-65eb-48fc-be05-e44aa66dc370","resolution":{"observed_at":"2026-08-07T23:01:11.657872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.635464Z","title":"Stop reasoning! when multimodal LLM with chain-of-thought reasoning meets adversarial image","venue":null,"work_id":"cf2eac71-0832-4606-9a8c-ef34a88feeb8","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.208502Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:41a306d66b6ab5e4c790da52313a21c04a31de8853b6d5f51bdd297711e923b8","observation_id":"cd7f1598-c511-4a95-be08-4e4fcc18bf64","resolution":{"observed_at":"2026-08-07T23:01:11.641105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.214274Z","title":"Reasoning about a rule","venue":null,"work_id":null,"year":1968},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.214274Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:fbcd49677b10ff2f6d18dbb038b25164ba30ad54e6e953c9e0e432af4c4fe65d","observation_id":"523390f7-d9df-4402-8005-f602006d1a32","resolution":{"observed_at":"2026-08-07T23:01:11.214274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.608270Z","title":"Psychology of reasoning: Structure and content, volume 86","venue":null,"work_id":"c24dcdd1-49c7-4c38-ad13-bda253f7ef73","year":1972},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.219217Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:c9b2eb86602657de6799ee61e42a17d2495bc0106a301efc57faafb3ed697662","observation_id":"31a4b7cb-f857-4452-8692-bae4b6eb6451","resolution":{"observed_at":"2026-08-07T23:01:11.613650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.224407Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.224407Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:b77f5fa0059e7694e7456ef20fc562694fb56ebbe1190cc94f389ce22e2f7138","observation_id":"a129231c-49c2-496d-a596-490885c9490f","resolution":{"observed_at":"2026-08-07T23:01:11.224407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.579274Z","title":"Jailbreak and guard aligned language models with only few in-context demonstrations","venue":null,"work_id":"c757be88-8b16-458d-bc8d-9f26d5e7ac8e","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.229256Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:613ad8011bc0691aac5ba3a163481959217d96b30f8649d83ead14b5200b8332","observation_id":"cb0ae263-c139-4c07-8729-0c65817df7d3","resolution":{"observed_at":"2026-08-07T23:01:11.584593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.562817Z","title":"Separate the wheat from the chaff: A post-hoc approach to safety re-alignment for fine-tuned language models","venue":null,"work_id":"5fa8310c-f550-41a0-80fd-0e880268da82","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.234069Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:67feec786e3ac5eaf00a5518581d9d31dfc73d5ec495b361b5a522b231689010","observation_id":"bdec4450-da11-40c4-9270-95a1a1d7164e","resolution":{"observed_at":"2026-08-07T23:01:11.568220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.547162Z","title":"You know what i'm saying: Jailbreak attack via implicit reference","venue":null,"work_id":"b1436ea6-a04f-4754-b6ba-4b69d7ce34fc","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.239087Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:1915420c3771a58144fcd8414f1a8c763d1ca145534f967eafdd76fbcfba217a","observation_id":"2dfe9c1a-9fc3-41ad-9799-6a46b511778d","resolution":{"observed_at":"2026-08-07T23:01:11.552269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.528575Z","title":"Qwen2.5-math technical report: Toward mathematical expert model via self-improvement","venue":null,"work_id":"a661816b-54cd-4ab7-a1d9-13f6b243db1a","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.244047Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:1d2255ddd75afad5a584f95f13ed128342b57c48d665c17d03c37209acbb21a9","observation_id":"0437f23b-0cbf-4cbf-bbba-354c5b41d048","resolution":{"observed_at":"2026-08-07T23:01:11.535154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.509605Z","title":"Wordcraft: story writing with large language models","venue":null,"work_id":"0585ddb3-1141-4112-ab54-507ef9a5d7d6","year":2022},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.249179Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:ec6f9793f17114b4b5ed605a98d91c2a81e5ba9ef0341173a5be703b2999d1c3","observation_id":"0e065b2c-fbd6-4527-923b-d21296da6571","resolution":{"observed_at":"2026-08-07T23:01:11.515058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.492334Z","title":"Prompting large language model for machine translation: A case study","venue":null,"work_id":"b461ee76-8fdf-4a10-93e8-a1c347eaf7b7","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.255031Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:1f5d733e50e82b7360529f9792250322d69c1f734cff96c45ba3779063ed0864","observation_id":"70a72902-5c93-4cad-9695-f51c4c12ccbf","resolution":{"observed_at":"2026-08-07T23:01:11.498001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.474405Z","title":"Grease LM : Graph REAS oning enhanced language models","venue":null,"work_id":"1253e6a0-4939-4666-bb04-735e95f46b85","year":2022},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.259747Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:12cdc951d5c7d8d5500cf21eb82410a8b0f4e0d3c2153233cda415e6eaee89e8","observation_id":"2b35dfea-7f87-4288-874c-1ee66fdd79ab","resolution":{"observed_at":"2026-08-07T23:01:11.479795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.457877Z","title":"S afety B ench: Evaluating the safety of large language models","venue":null,"work_id":"772e7a09-baa1-4d55-b14f-c13fd5d989a9","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.264691Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:f36c8a6611ff34c21197a31ddd213ae8cba3675dd4cddf8cba1185f31d849e23","observation_id":"d84f023b-f861-455c-a97b-3f334b63f3c2","resolution":{"observed_at":"2026-08-07T23:01:11.463195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.439923Z","title":"Automatic chain of thought prompting in large language models","venue":null,"work_id":"0295c2df-b1e6-4c63-8e51-bb14e5d41b72","year":2022},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.269644Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:7f8a92faa9cfa6526b2be4a7b0bde9bd912bd943722ede315efbf29f8582d6ba","observation_id":"c65d5575-6fac-4a35-964f-1b79e41e662d","resolution":{"observed_at":"2026-08-07T23:01:11.446218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.420526Z","title":"Verify-and-edit: A knowledge-enhanced chain-of-thought framework","venue":null,"work_id":"eb2512e7-962e-43a0-b354-578a2022c4bd","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.274376Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:fe07d6f084f449198cde7c371c0ef32bb17879f3c738f227c73e756b462e138e","observation_id":"60519221-98fb-4cac-91ad-ba56ada95cf5","resolution":{"observed_at":"2026-08-07T23:01:11.426107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.401698Z","title":"Marco-o1: Towards open reasoning models for open-ended solutions","venue":null,"work_id":"12a848a3-b110-4d8b-8f5e-880ec988eccf","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.279203Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:c406dba2d89485d1d051c8980b2642ef2b444cbf47796cacfed3b49626f0a4d6","observation_id":"ee34849b-a03c-4813-a8b7-8ff152539db9","resolution":{"observed_at":"2026-08-07T23:01:11.407699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.381797Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":"ec18bf8a-99b5-49b3-b2a4-52e653cb5b91","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.283839Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:bd3c8ef2094dcd0712b03de11ca480c07631da5594f4e2c420b16b74a53cf6e6","observation_id":"56ae1af9-3b33-4b66-91a4-7fe594d87025","resolution":{"observed_at":"2026-08-07T23:01:11.386923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.365377Z","title":"Rethinking machine ethics -- can LLM s perform moral reasoning through the lens of moral theories? In ACL, 2024","venue":null,"work_id":"5237c327-d5ed-4d0c-82cc-44522576cb78","year":2024},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.288350Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:54891761f9c614643fd230e399e056ec395ebe428bbdbd90e0ccfc4c89060ece","observation_id":"72c6dc05-d912-4b1f-aa7f-a8c6f15f6656","resolution":{"observed_at":"2026-08-07T23:01:11.370628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:01:11.346216Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":"d2b04199-63df-4c45-8d0b-4a5ab06d5f1a","year":2023},"citing_paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T23:01:11.293318Z"},"links":{"citing_paper":"/paper/2502.09673"},"observation_digest":"sha256:d7ac7e127cee55613a021de004126978bee4166bbe52dfac2b1841580621521f","observation_id":"effc4cce-a01c-4790-a563-e8ee8c9c0b52","resolution":{"observed_at":"2026-08-07T23:01:11.353525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.09673","last_updated":"2025-02-21T03:12:17Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T22:55:22.773164Z","submitted_at":"2025-02-13T06:37:28Z","title":"Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":56},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 8 inbound Pith citation observations for arXiv:2502.09673."}