{"as_of":"2026-08-20T04:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:59ff0f9817656ac6158144d25b6b71ee9a6f4d8fc25faaf8e018ec2d6697a92e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:32:31.266176Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T03:26:28.590637Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-10T20:32:31.266176Z","title":"DeepSeek-AI, Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Ruoyu Zhang, Runxin Xu, Qihao Zhu, Shirong Ma, Peiyi Wang, Xiao Bi, Xiaokang Zhang, Xingkai Yu, Yu Wu, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.08156","last_updated":"2025-07-15T17:27:07Z","snapshot_observed_at":"2026-08-14T16:34:08.653777Z","submitted_at":"2025-01-14T14:31:45Z","title":"Are DeepSeek R1 And Other Reasoning Models More Faithful?","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:32:31.266176Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2501.08156"},"observation_digest":"sha256:9adf09cae6f8534956275b8b394695566d54100dd0a4a3ab43bbcd3a360890cf","observation_id":"2ecc8585-2b03-480a-8af9-d8778df6aeac","resolution":{"observed_at":"2026-08-10T20:32:31.266176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-06T22:03:52.256909Z","title":"R., Michael, J., Perez, E., and Turpin, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22777","last_updated":"2025-07-13T15:36:35Z","snapshot_observed_at":"2026-08-17T01:23:04.052232Z","submitted_at":"2025-06-28T06:37:10Z","title":"Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:03:52.256909Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2506.22777"},"observation_digest":"sha256:cbec27cca620b7f204309d082b25393b7d72ef05b877cb5a74210f06e9ffa73e","observation_id":"246b518d-1ab1-4735-b78f-3311d85ac3f2","resolution":{"observed_at":"2026-08-06T22:03:52.256909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-06T11:06:07.155650Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought [Internet]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23146","last_updated":"2026-07-22T18:38:53Z","snapshot_observed_at":"2026-08-12T23:58:52.590692Z","submitted_at":"2025-07-30T22:48:34Z","title":"Lightweight Language Models are Prone to Reasoning Errors for Complex Computational Phenotyping Tasks","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:06:07.155650Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2507.23146"},"observation_digest":"sha256:834a3ec0e3a613afc57eb6eb6ee6114f4e319e537d0d75b77c340dbc41f01628","observation_id":"024f890d-d398-4dd5-8c37-feb8dc44ad1d","resolution":{"observed_at":"2026-08-06T11:06:07.155650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-05T16:57:07.932075Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17511","last_updated":"2025-08-24T20:23:08Z","snapshot_observed_at":"2026-08-14T01:23:22.506041Z","submitted_at":"2025-08-24T20:23:08Z","title":"School of Reward Hacks: Hacking harmless tasks generalizes to misaligned behavior in LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:57:07.932075Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2508.17511"},"observation_digest":"sha256:c2548337bc0654e8cecf2df6d0518650300a4f5126b3bcb81efe119304f1dd9c","observation_id":"d127ecec-5b7a-47ac-9555-212bc4cadb32","resolution":{"observed_at":"2026-08-05T16:57:07.932075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-04T10:40:43.208031Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09278","last_updated":"2026-06-28T16:27:56Z","snapshot_observed_at":"2026-08-17T20:34:52.934822Z","submitted_at":"2025-10-10T11:21:09Z","title":"CLARity: Reasoning Consistency Alone Can Teach Reinforced Experts","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T10:40:43.208031Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2510.09278"},"observation_digest":"sha256:6a085cf9f9f4287d9ad643855ad2f441644b7bf6eb03e80202f24811a877af67","observation_id":"7bba21fd-6a2b-42b2-9553-09838920feee","resolution":{"observed_at":"2026-08-04T10:40:43.208031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.03226","last_updated":"2026-06-08T16:31:56Z","snapshot_observed_at":"2026-08-17T02:44:14.919973Z","submitted_at":"2026-05-04T23:30:29Z","title":"Self-Mined Hardness for Safety Fine-Tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-08T18:23:49.808496Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.03226"},"observation_digest":"sha256:ae041334df18a4d26792982a519838417b2593f8c0ed51329c7e7058a2088d3f","observation_id":"d62869b0-67d9-4927-ab27-37fd599b6578","resolution":{"observed_at":"2026-05-09T06:30:42.596013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.03226","last_updated":"2026-06-08T16:31:56Z","snapshot_observed_at":"2026-08-17T02:44:14.919973Z","submitted_at":"2026-05-04T23:30:29Z","title":"Self-Mined Hardness for Safety Fine-Tuning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:36.068713Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.03226"},"observation_digest":"sha256:074d48d76cdada661d565d382b4808423299aeab091d16ff7084f7033003b1b2","observation_id":"75f0719d-4146-419f-aa94-141cfbe7a3df","resolution":{"observed_at":"2026-07-01T00:55:12.260584Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.21834","last_updated":"2026-05-20T23:56:40Z","snapshot_observed_at":"2026-08-16T16:21:02.836051Z","submitted_at":"2026-05-20T23:56:40Z","title":"On-Policy Consistency Training Improves LLM Safety with Minimal Capability Degradation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T08:39:02.671206Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.21834"},"observation_digest":"sha256:a7555accd37a6d0ed820b9fabb33e5aad5164e2e8c21d5e380b8fdc9b850893c","observation_id":"005e25dd-55de-4a2b-9b48-e2d97c4e39db","resolution":{"observed_at":"2026-05-22T08:41:17.059273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.24279","last_updated":"2026-05-22T23:13:21Z","snapshot_observed_at":"2026-08-14T00:32:02.574383Z","submitted_at":"2026-05-22T23:13:21Z","title":"ContextEcho: A Benchmark for Persona Drift in Long Agentic-Coding Sessions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T15:17:37.904831Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.24279"},"observation_digest":"sha256:dd688bdb0b19bd917a3c4563b6c72df0d78cdc896721f3f86da54c0a06557202","observation_id":"cc38c616-bde8-43e4-bd2d-9fd541271804","resolution":{"observed_at":"2026-06-30T15:34:48.444243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.28467","last_updated":"2026-05-27T13:33:26Z","snapshot_observed_at":"2026-08-05T22:05:24.662345Z","submitted_at":"2026-05-27T13:33:26Z","title":"Mitigating Adaptive Attacks against Reasoning Models with Activation Consistency Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T14:18:16.033063Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.28467"},"observation_digest":"sha256:8d15f31a2e4e93f976614929796be390755927de0c4a75f12274aa3f5b4e4b6e","observation_id":"75b436ba-9072-44e9-9cf1-b10b6796b2b6","resolution":{"observed_at":"2026-06-29T14:23:30.709678Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2606.03810","last_updated":"2026-06-03T10:22:34Z","snapshot_observed_at":"2026-08-15T15:37:28.872815Z","submitted_at":"2026-06-02T15:54:24Z","title":"Consistency Training Can Entrench Misalignment","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-28T10:07:31.153337Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2606.03810"},"observation_digest":"sha256:06a2c1ee872a8dff29a106291e82ff763216fac8bd7808fdf95484e7feda5e96","observation_id":"d6bd0c7c-2b81-4f69-b622-c169ec6ad9b8","resolution":{"observed_at":"2026-07-02T03:26:28.592210Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-01T08:36:28.549466Z","title":"and Michael, Julian and Perez, Ethan and Turpin, Miles , urldate =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21090","last_updated":"2026-07-23T09:20:38Z","snapshot_observed_at":"2026-08-17T18:15:25.156500Z","submitted_at":"2026-07-23T09:20:38Z","title":"Training Large Language Models for Self-Explanation Faithfulness","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-08-01T08:36:28.549466Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2607.21090"},"observation_digest":"sha256:b156eb48375e05878d8e7f98d3a332d4b86937833552a1d18f2896302689c0a9","observation_id":"2ec7fa9d-9a25-48da-b92d-e016c4c1eeeb","resolution":{"observed_at":"2026-08-01T08:36:28.549466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.05518/citation-record","integrity":"/paper/2403.05518/integrity","json":"/paper/2403.05518/citation-record.json","paper":"/paper/2403.05518"},"outbound":[],"paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T14:11:31.512550Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2403.05518."}