{"as_of":"2026-08-17T13:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d408e2446d738c5d375b35e7b0441ced0cfc1c55fcc934122f265f261cf1f33e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:01:05.028500Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.18711","last_updated":"2024-12-05T04:01:28Z","snapshot_observed_at":"2026-08-16T13:48:22.669302Z","submitted_at":"2024-05-29T02:44:12Z","title":"Calibrating Reasoning in Language Models with Internal Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18711","snapshot_observed_at":"2026-08-10T23:01:05.028500Z","title":"Calibrating reasoning in language models with internal consistency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00257","last_updated":"2024-12-31T03:56:17Z","snapshot_observed_at":"2026-08-14T08:35:19.921704Z","submitted_at":"2024-12-31T03:56:17Z","title":"EQUATOR: A Deterministic Framework for Evaluating LLM Reasoning with Open-Ended Questions. # v1.0.0-beta","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:05.028500Z"},"links":{"cited_paper":"/paper/2405.18711","citing_paper":"/paper/2501.00257"},"observation_digest":"sha256:96246f2c54558959c3fce301f805734d3eeeb54866daa66597b9ea565b21347b","observation_id":"5181b783-d8b3-4886-b614-6d16f5062f3b","resolution":{"observed_at":"2026-08-10T23:01:05.028500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18711","last_updated":"2024-12-05T04:01:28Z","snapshot_observed_at":"2026-08-16T13:48:22.669302Z","submitted_at":"2024-05-29T02:44:12Z","title":"Calibrating Reasoning in Language Models with Internal Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18711","snapshot_observed_at":"2026-08-10T14:43:55.504664Z","title":"”Calibrating Reasoning in Lan- guage Models with Internal Consistency.” arXiv preprint arXiv:2405.18711 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.15714","last_updated":"2025-01-25T04:18:35Z","snapshot_observed_at":"2026-08-17T08:43:50.399631Z","submitted_at":"2025-01-25T04:18:35Z","title":"TrustDataFilter:Leveraging Trusted Knowledge Base Data for More Effective Filtering of Unknown Information","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:55.504664Z"},"links":{"cited_paper":"/paper/2405.18711","citing_paper":"/paper/2502.15714"},"observation_digest":"sha256:0cd12ab15de38ac25f45a9cb8d4abe5df741c9c32e6229f12f7157a373089634","observation_id":"4ef7ca4e-bec8-44c0-ab10-ec8f368494cc","resolution":{"observed_at":"2026-08-10T14:43:55.504664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18711","last_updated":"2024-12-05T04:01:28Z","snapshot_observed_at":"2026-08-16T13:48:22.669302Z","submitted_at":"2024-05-29T02:44:12Z","title":"Calibrating Reasoning in Language Models with Internal Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18711","snapshot_observed_at":"2026-08-07T14:37:23.112070Z","title":"In Findings of the Association for Computational Linguistics: EMNLP 2023, pages 2550–2575","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18404","last_updated":"2025-05-23T22:17:18Z","snapshot_observed_at":"2026-08-17T08:32:45.419089Z","submitted_at":"2025-05-23T22:17:18Z","title":"Thought calibration: Efficient and confident test-time scaling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:37:23.112070Z"},"links":{"cited_paper":"/paper/2405.18711","citing_paper":"/paper/2505.18404"},"observation_digest":"sha256:5b76dd4ed3ce19713f9976586c7d555303726e5ea82dbd0816b05f9d1b1cf62f","observation_id":"8df164f5-697f-43d6-b5ff-144f8a4bbc79","resolution":{"observed_at":"2026-08-07T14:37:23.112070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18711","last_updated":"2024-12-05T04:01:28Z","snapshot_observed_at":"2026-08-16T13:48:22.669302Z","submitted_at":"2024-05-29T02:44:12Z","title":"Calibrating Reasoning in Language Models with Internal Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18711","snapshot_observed_at":"2026-08-06T21:55:09.731546Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23274","last_updated":"2026-05-26T11:19:37Z","snapshot_observed_at":"2026-08-06T21:45:00.363997Z","submitted_at":"2025-06-29T15:01:01Z","title":"Real-Time Progress Prediction in Reasoning Language Models","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T21:55:09.731546Z"},"links":{"cited_paper":"/paper/2405.18711","citing_paper":"/paper/2506.23274"},"observation_digest":"sha256:add18f401e2e8a88c66d4b4550c1b282bd95e25e18468b472b34e347678307cd","observation_id":"76723c02-3a6e-4370-8365-9712de7876e8","resolution":{"observed_at":"2026-08-06T21:55:09.731546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18711","last_updated":"2024-12-05T04:01:28Z","snapshot_observed_at":"2026-08-16T13:48:22.669302Z","submitted_at":"2024-05-29T02:44:12Z","title":"Calibrating Reasoning in Language Models with Internal Consistency","version":2},"cited_work":{"arxiv_id":"2405.18711","doi":"10.48550/arxiv.2405.18711","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.18711","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Calibrating","venue":"arXiv (Cornell University)","work_id":"817a0033-5c0a-4271-af4e-52ca64410036","year":2024},"citing_paper":{"arxiv_id":"2605.05851","last_updated":"2026-05-07T08:24:54Z","snapshot_observed_at":"2026-08-04T15:23:48.540297Z","submitted_at":"2026-05-07T08:24:54Z","title":"Hypothesis generation and updating in large language models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-08T14:43:56.125546Z"},"links":{"cited_paper":"/paper/2405.18711","citing_paper":"/paper/2605.05851"},"observation_digest":"sha256:53e0cda258ea05dfb8375ce22609c1a91d1f5892da08308dff3e88b6020181d3","observation_id":"e23c75d5-2a11-46e4-85fa-f7bd3e166791","resolution":{"observed_at":"2026-05-08T21:14:12.111952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18711","last_updated":"2024-12-05T04:01:28Z","snapshot_observed_at":"2026-08-16T13:48:22.669302Z","submitted_at":"2024-05-29T02:44:12Z","title":"Calibrating Reasoning in Language Models with Internal Consistency","version":2},"cited_work":{"arxiv_id":"2405.18711","doi":"10.48550/arxiv.2405.18711","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.18711","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Calibrating","venue":"arXiv (Cornell University)","work_id":"817a0033-5c0a-4271-af4e-52ca64410036","year":2024},"citing_paper":{"arxiv_id":"2605.27712","last_updated":"2026-05-26T21:37:20Z","snapshot_observed_at":"2026-08-15T05:38:13.699058Z","submitted_at":"2026-05-26T21:37:20Z","title":"Prefix-Safe Bayesian Belief Tracking for LLM Reasoning Reliability:Separating Calibration from Ranking","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-29T16:59:25.127619Z"},"links":{"cited_paper":"/paper/2405.18711","citing_paper":"/paper/2605.27712"},"observation_digest":"sha256:3885ecda80ba9dd1144ab8e6bf9436d948505f25b4bc1f39863a520cb62fe801","observation_id":"1a876b12-015d-4873-b625-e0991d9ea140","resolution":{"observed_at":"2026-06-29T17:03:40.952645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18711","last_updated":"2024-12-05T04:01:28Z","snapshot_observed_at":"2026-08-16T13:48:22.669302Z","submitted_at":"2024-05-29T02:44:12Z","title":"Calibrating Reasoning in Language Models with Internal Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18711","snapshot_observed_at":"2026-08-02T02:44:36.408565Z","title":"Calibrating reasoning in language models with internal consistency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14242","last_updated":"2026-07-15T18:03:08Z","snapshot_observed_at":"2026-08-14T09:53:27.449814Z","submitted_at":"2026-07-15T18:03:08Z","title":"Implicit Reasoning Steering via Concept Chaining","version":1},"reference_index":176,"source":"arxiv_source","source_observed_at":"2026-08-02T02:44:36.408565Z"},"links":{"cited_paper":"/paper/2405.18711","citing_paper":"/paper/2607.14242"},"observation_digest":"sha256:c1bc76c37e4b06a981940dbab1ac86e71e09ae99b422cbb8fdc5e15d33eda625","observation_id":"0668da5f-5e37-4fea-b061-d3e0d3dccbfe","resolution":{"observed_at":"2026-08-02T02:44:36.408565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18711","last_updated":"2024-12-05T04:01:28Z","snapshot_observed_at":"2026-08-16T13:48:22.669302Z","submitted_at":"2024-05-29T02:44:12Z","title":"Calibrating Reasoning in Language Models with Internal Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18711","snapshot_observed_at":"2026-08-08T04:41:09.755763Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05660","last_updated":"2026-08-06T06:58:10Z","snapshot_observed_at":"2026-08-14T23:00:04.602528Z","submitted_at":"2026-08-06T06:58:10Z","title":"Reasoning Errors Have a Region and a Direction in the Residual-Stream Trajectory of LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T04:41:09.755763Z"},"links":{"cited_paper":"/paper/2405.18711","citing_paper":"/paper/2608.05660"},"observation_digest":"sha256:bdcd6e076fd3d26105e84e7a99ae571b70f435f87eded1a36ea9fa43ea52600d","observation_id":"3abaf288-7040-4be4-8843-602d0247138d","resolution":{"observed_at":"2026-08-08T04:41:09.755763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.18711/citation-record","integrity":"/paper/2405.18711/integrity","json":"/paper/2405.18711/citation-record.json","paper":"/paper/2405.18711"},"outbound":[],"paper":{"arxiv_id":"2405.18711","last_updated":"2024-12-05T04:01:28Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T13:48:22.669302Z","submitted_at":"2024-05-29T02:44:12Z","title":"Calibrating Reasoning in Language Models with Internal Consistency"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2405.18711."}