{"as_of":"2026-08-15T16:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f7e0eb7cb6555a1e413cd750794b32791fab808fc6a1a5d4166b168c61e58956","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:18:17.280116Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-11T14:18:17.280116Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12318","last_updated":"2025-03-20T15:13:26Z","snapshot_observed_at":"2026-08-14T00:40:02.264754Z","submitted_at":"2024-12-16T19:35:55Z","title":"Graph-Guided Textual Explanation Generation Framework","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T14:18:17.280116Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2412.12318"},"observation_digest":"sha256:7d738b9e085064db5b0e739169956f81b9f836ca56f9eb3cddf5e5d43ec1ff9f","observation_id":"cdcf9ed1-56fc-4d97-84f8-5859871475be","resolution":{"observed_at":"2026-08-11T14:18:17.280116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-09T18:47:52.813212Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00498","last_updated":"2025-02-01T17:31:25Z","snapshot_observed_at":"2026-08-10T09:25:23.834904Z","submitted_at":"2025-02-01T17:31:25Z","title":"MetaOpenFOAM 2.0: Large Language Model Driven Chain of Thought for Automating CFD Simulation and Post-Processing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T18:47:52.813212Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2502.00498"},"observation_digest":"sha256:6ec884b5f6d4ffbf01aa958ddbfc1dc46bb7c7ae344aa4d6b86449d450f803ed","observation_id":"cd179fd0-e071-4722-b82b-e15b89589d5e","resolution":{"observed_at":"2026-08-09T18:47:52.813212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T17:29:04.638177Z","title":"The Cancer Genome Atlas Program","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.16315","last_updated":"2025-08-25T17:04:49Z","snapshot_observed_at":"2026-08-15T16:34:08.282584Z","submitted_at":"2025-08-22T11:52:04Z","title":"OwkinZero: Accelerating Biological Discovery with AI","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T17:29:04.638177Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2508.16315"},"observation_digest":"sha256:0af2efa273dfedb8896f0324ed12ea52f791ebb95feb255c6d1604d26ccd9b34","observation_id":"62719d44-efa0-405d-9abc-fa7a3b47f033","resolution":{"observed_at":"2026-08-05T17:29:04.638177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T17:40:54.301852Z","title":"Making reasoning matter: Measur- ing and improving faithfulness of chain-of-thought reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16695","last_updated":"2025-08-21T23:48:50Z","snapshot_observed_at":"2026-08-12T04:56:27.077413Z","submitted_at":"2025-08-21T23:48:50Z","title":"Do Cognitively Interpretable Reasoning Traces Improve LLM Performance?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T17:40:54.301852Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2508.16695"},"observation_digest":"sha256:6ef9b8684b678ba0e6baa146e6e3b3bbafbb513d98912304cf558ac0a644d2f9","observation_id":"5854ae43-60be-495c-8d42-70b940f74dd0","resolution":{"observed_at":"2026-08-05T17:40:54.301852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-04T12:41:42.777000Z","title":"Making reasoning matter: Measur- ing and improving faithfulness of chain-of-thought reasoning.arXiv preprint arXiv:2402.13950,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02919","last_updated":"2026-05-29T16:16:27Z","snapshot_observed_at":"2026-08-07T08:42:12.238625Z","submitted_at":"2025-10-03T11:46:04Z","title":"Self-Reflective Generation at Test Time","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T12:41:42.777000Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2510.02919"},"observation_digest":"sha256:15205d0a2538818d220e9ce058b35cfb7c968ed363e93884519769343204f1b1","observation_id":"f5622d77-e35d-4133-9a74-5ddc57809070","resolution":{"observed_at":"2026-08-04T12:41:42.777000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-04T10:40:47.386849Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.09278","last_updated":"2026-06-28T16:27:56Z","snapshot_observed_at":"2026-08-15T15:53:13.085128Z","submitted_at":"2025-10-10T11:21:09Z","title":"CLARity: Reasoning Consistency Alone Can Teach Reinforced Experts","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T10:40:47.386849Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2510.09278"},"observation_digest":"sha256:fc88f1d137359d3e9a6d22b21f1fd824ed02baca967bf13d059c71cb49a0fcb8","observation_id":"a003e3a2-a1a3-4431-917c-c05e411e3e94","resolution":{"observed_at":"2026-08-04T10:40:47.386849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-03T21:09:25.221007Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16478","last_updated":"2026-07-20T11:57:11Z","snapshot_observed_at":"2026-08-08T04:23:14.885822Z","submitted_at":"2025-11-20T15:46:27Z","title":"Music Recommendation with Large Language Models: Challenges, Opportunities, and Evaluation","version":2},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:25.221007Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2511.16478"},"observation_digest":"sha256:5f6c753611de99a6a31aa7e1a6d4d75b2ed5b50149e9ad2251d94d6c0c28ee2a","observation_id":"669ad559-149d-446c-b4ed-e2ac2ac1b8f7","resolution":{"observed_at":"2026-08-03T21:09:25.221007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2512.07407","last_updated":"2026-06-25T12:41:26Z","snapshot_observed_at":"2026-08-14T03:06:22.486358Z","submitted_at":"2025-12-08T10:39:38Z","title":"Training Language Models to Use Prolog as a Tool","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T01:15:43.096577Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2512.07407"},"observation_digest":"sha256:e5ab7a009f131ef3f5c3e7a59d3d50e93c325ce02ca6651a36ad7b93a7fd720b","observation_id":"344a4803-c6e1-4cef-9fd2-c1ff94c9ff56","resolution":{"observed_at":"2026-05-17T01:18:48.436324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-03T18:01:23.106483Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning.arXiv:2402.13950, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.07407","last_updated":"2026-06-25T12:41:26Z","snapshot_observed_at":"2026-08-14T03:06:22.486358Z","submitted_at":"2025-12-08T10:39:38Z","title":"Training Language Models to Use Prolog as a Tool","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T18:01:23.106483Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2512.07407"},"observation_digest":"sha256:3eae2e6e1ca7c389728ec35015e295bfb8b47f56ca45feecd13cecfe843fc0f3","observation_id":"61bd8538-6cb4-49bf-ac1f-56ab0af9eb93","resolution":{"observed_at":"2026-08-03T18:01:23.106483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-03T08:15:27.273637Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.17717","last_updated":"2026-06-09T20:25:14Z","snapshot_observed_at":"2026-08-08T23:34:38.789355Z","submitted_at":"2026-01-25T06:40:25Z","title":"A Survey on Evaluating Quality and Trustworthiness in LLM-Generated Data","version":3},"reference_index":165,"source":"arxiv_source","source_observed_at":"2026-08-03T08:15:27.273637Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2601.17717"},"observation_digest":"sha256:3b30b35c92ef094c82363853ed40ced44b39d3c13b18781c729c389cb3311bf7","observation_id":"1a67d5fe-2db1-4825-be8b-b753830b974c","resolution":{"observed_at":"2026-08-03T08:15:27.273637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2604.13392","last_updated":"2026-05-19T05:20:16Z","snapshot_observed_at":"2026-08-14T06:01:13.323154Z","submitted_at":"2026-04-15T01:43:00Z","title":"ReSS: Learning Reasoning Models for Tabular Data Prediction via Symbolic Scaffold","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-10T13:57:36.981142Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2604.13392"},"observation_digest":"sha256:04f85dc104b4aa5e3786ed16b56cbbf4462f3f3b4e045292d400f7e3cd15fd4f","observation_id":"43f79d4b-0f1a-474b-bbd2-159c73bbcb88","resolution":{"observed_at":"2026-05-10T14:00:29.061203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2604.13392","last_updated":"2026-05-19T05:20:16Z","snapshot_observed_at":"2026-08-14T06:01:13.323154Z","submitted_at":"2026-04-15T01:43:00Z","title":"ReSS: Learning Reasoning Models for Tabular Data Prediction via Symbolic Scaffold","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-21T01:00:20.188501Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2604.13392"},"observation_digest":"sha256:a163e7a890bb4aa48e2db77a39b8f8d15e9b40240bd0bd22d0f1c487a3a24239","observation_id":"c8ea0c65-a0cd-4fa0-950d-f566186a0ffe","resolution":{"observed_at":"2026-05-21T01:03:53.028928Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2605.01704","last_updated":"2026-05-05T16:21:16Z","snapshot_observed_at":"2026-08-13T03:07:49.481506Z","submitted_at":"2026-05-03T04:12:21Z","title":"The Reasoning Trap: An Information-Theoretic Bound on Closed-System Multi-Step LLM Reasoning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-10T15:52:43.274993Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2605.01704"},"observation_digest":"sha256:5aca6fca1025a405081bf37d4883d870a0182f3c998099404bd6d08a416645b3","observation_id":"0ce75d48-d798-4dc8-88e8-db63868eef39","resolution":{"observed_at":"2026-05-11T09:41:03.976968Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2605.12824","last_updated":"2026-05-17T05:34:27Z","snapshot_observed_at":"2026-08-11T21:38:46.840296Z","submitted_at":"2026-05-12T23:46:39Z","title":"Mechanism Plausibility in Generative Agent-Based Modeling","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-14T19:24:53.816091Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2605.12824"},"observation_digest":"sha256:16601f2673bc3d6080d554da0b2350dab7883ed91e27efab64285dd798ec5c3a","observation_id":"429f5d5f-38e0-4c7a-add5-314ac18b5c71","resolution":{"observed_at":"2026-05-14T19:27:50.923984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2605.12824","last_updated":"2026-05-17T05:34:27Z","snapshot_observed_at":"2026-08-11T21:38:46.840296Z","submitted_at":"2026-05-12T23:46:39Z","title":"Mechanism Plausibility in Generative Agent-Based Modeling","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-20T20:51:54.829821Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2605.12824"},"observation_digest":"sha256:38e6cd12cfb65775f4f4eb072985b20614a977cd1f3001a6c29753b773b2b822","observation_id":"f26797f6-ac5f-4497-9b67-0c761a3bc278","resolution":{"observed_at":"2026-05-20T20:53:43.326278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2605.24661","last_updated":"2026-07-01T08:31:40Z","snapshot_observed_at":"2026-08-14T09:53:26.348335Z","submitted_at":"2026-05-23T17:03:42Z","title":"Measuring Reasoning Quality in LLMs: A Multi-Dimensional Behavioral Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T13:27:50.367497Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2605.24661"},"observation_digest":"sha256:4f5d503e0c1ae4c247e78cd9db6bf2bb10799b3d6eb421b192e58df5d76a94c8","observation_id":"6f8330f5-ea30-4fca-8b39-95bcb00d40ab","resolution":{"observed_at":"2026-06-30T13:34:40.591100Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2605.24661","last_updated":"2026-07-01T08:31:40Z","snapshot_observed_at":"2026-08-14T09:53:26.348335Z","submitted_at":"2026-05-23T17:03:42Z","title":"Measuring Reasoning Quality in LLMs: A Multi-Dimensional Behavioral Framework","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-01T07:35:51.017797Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2605.24661"},"observation_digest":"sha256:a789316cb9835abc901acd0aed427c48c2b95b2806bf6806d073de91cef95677","observation_id":"b2974b76-6f6c-4261-8ea0-90887e57f827","resolution":{"observed_at":"2026-07-01T08:05:31.899167Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2605.24661","last_updated":"2026-07-01T08:31:40Z","snapshot_observed_at":"2026-08-14T09:53:26.348335Z","submitted_at":"2026-05-23T17:03:42Z","title":"Measuring Reasoning Quality in LLMs: A Multi-Dimensional Behavioral Framework","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-02T23:22:08.567841Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2605.24661"},"observation_digest":"sha256:5e805f5bb1a45d1dbac50e00141dcc862c645beaa8cb8220ed463acbea0c4a7d","observation_id":"00070c01-c549-4fab-a583-aac1ff5ed4ea","resolution":{"observed_at":"2026-07-02T23:27:26.719497Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2605.25603","last_updated":"2026-05-25T08:54:55Z","snapshot_observed_at":"2026-08-10T09:24:29.678831Z","submitted_at":"2026-05-25T08:54:55Z","title":"Detecting Unfaithful Chain-of-Thought via Circuit-Guided Internal-External Discrepancy","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T21:47:17.894881Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2605.25603"},"observation_digest":"sha256:2796a21292f54d17a40222037e4b60daf043d52767695ad95a90b22124d61d89","observation_id":"6734681c-ff98-4261-9efc-bfeb70bd1124","resolution":{"observed_at":"2026-06-29T21:53:59.531891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":"2402.13950","doi":"10.48550/arxiv.2402.13950","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Making reasoning matter: Measuring and improving faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"3144fc98-4ebd-46df-9977-472d6a0f987b","year":2024},"citing_paper":{"arxiv_id":"2607.00924","last_updated":"2026-07-01T13:26:10Z","snapshot_observed_at":"2026-08-07T23:46:28.286621Z","submitted_at":"2026-07-01T13:26:10Z","title":"Graph-Native Reinforcement Learning Enables Traceable Scientific Hypothesis Generation through Conceptual Recombination","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-02T12:26:46.384850Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2607.00924"},"observation_digest":"sha256:e98b3e64fe4d6961d19204b4fab9576f7acf7f6f8c281363a6c8d9ce3ca4c8db","observation_id":"b45ffc0e-525e-4a8a-b6f8-e112a35cc641","resolution":{"observed_at":"2026-07-02T12:26:55.874060Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-01T08:36:24.761289Z","title":"2024 , date=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21090","last_updated":"2026-07-23T09:20:38Z","snapshot_observed_at":"2026-08-13T09:06:20.160036Z","submitted_at":"2026-07-23T09:20:38Z","title":"Training Large Language Models for Self-Explanation Faithfulness","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T08:36:24.761289Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2607.21090"},"observation_digest":"sha256:debc7afd66123d6b505cef672cdb0253ab4ff1bba4bcb5956e48daf9dc91db1b","observation_id":"dddbd25d-30da-4937-972f-1b8dc8f22db9","resolution":{"observed_at":"2026-08-01T08:36:24.761289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13950","snapshot_observed_at":"2026-08-01T08:36:28.767008Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21090","last_updated":"2026-07-23T09:20:38Z","snapshot_observed_at":"2026-08-13T09:06:20.160036Z","submitted_at":"2026-07-23T09:20:38Z","title":"Training Large Language Models for Self-Explanation Faithfulness","version":1},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-08-01T08:36:28.767008Z"},"links":{"cited_paper":"/paper/2402.13950","citing_paper":"/paper/2607.21090"},"observation_digest":"sha256:99d4e74fcecfda6ccb5ee9d7c04a58ff9fa71fbc55ad9a9a4ec4bce24bc71003","observation_id":"628fe6e9-acd7-4bff-b3d6-10f8aea2e7c7","resolution":{"observed_at":"2026-08-01T08:36:28.767008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.13950/citation-record","integrity":"/paper/2402.13950/integrity","json":"/paper/2402.13950/citation-record.json","paper":"/paper/2402.13950"},"outbound":[],"paper":{"arxiv_id":"2402.13950","last_updated":"2024-10-06T17:54:06Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T10:22:14.960897Z","submitted_at":"2024-02-21T17:23:59Z","title":"Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2402.13950."}