{"as_of":"2026-08-17T18:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86a12e00182594008a4cf65d79b613a9901d86e5411f2a4cb3913bf7c3e21c9e","coverage":[{"denominator":10,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T09:33:15.230764Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:38:32.269935Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-14T06:16:15.895014Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"cited_work":{"arxiv_id":"2601.13735","doi":"10.48550/arxiv.2601.13735","metadata_source":"pith","pith_arxiv_id":"2601.13735","snapshot_observed_at":"2026-08-14T06:16:15.895014Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","venue":"cs.AI","work_id":"26f8312e-fd3e-4143-9027-c241f31663d6","year":2026},"citing_paper":{"arxiv_id":"2608.08514","last_updated":"2026-08-09T06:22:02Z","snapshot_observed_at":"2026-08-16T00:42:39.309672Z","submitted_at":"2026-08-09T06:22:02Z","title":"Reproducing and Stress-Testing Two Approaches to LLM Reasoning Reliability: Test-Time Probability Aggregation and Logic-Representation Editing","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-14T04:38:32.269935Z"},"links":{"cited_paper":"/paper/2601.13735","citing_paper":"/paper/2608.08514"},"observation_digest":"sha256:c5482fb493b7ca64631e367f6a6155937d5920ae4d3108a9a432877eb068755e","observation_id":"06450b15-ec85-4e10-bb5b-cfc1138584e7","resolution":{"observed_at":"2026-08-14T04:38:33.518993Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.13735/citation-record","integrity":"/paper/2601.13735/integrity","json":"/paper/2601.13735/citation-record.json","paper":"/paper/2601.13735"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:33:14.880865Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:14.880865Z"},"links":{"citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:5445dd21b2d718253fb1a45e31e8b012879b5d4f10fe231e16bb61b5d084322b","observation_id":"6ac8f484-6880-4bfb-9e13-a17370e1c783","resolution":{"observed_at":"2026-08-03T09:33:14.880865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:33:14.984757Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:14.984757Z"},"links":{"citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:764006e5893c33e2345e40909f2bd5f886485a7b18f580f41d4b90a8a5b64b94","observation_id":"94caa034-92a6-4c85-b6fb-f76e8a92419b","resolution":{"observed_at":"2026-08-03T09:33:14.984757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:33:15.039658Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:15.039658Z"},"links":{"citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:ab6e5c248915acd135d10fa2080a61b07d5e02076aa1a6b8586efd7c0f37df96","observation_id":"ede44ebf-9efc-464d-94f7-81060dc46662","resolution":{"observed_at":"2026-08-03T09:33:15.039658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-03T09:33:14.592921Z","title":"InProceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, pages 33759–33780","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:14.592921Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:a89f876cf321a30e269c733ede9a673429b3f5e631727881ad594aa79446095b","observation_id":"63b49082-67c0-4478-98ad-06e20ee616cc","resolution":{"observed_at":"2026-08-03T09:33:14.592921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T09:33:14.704610Z","title":"Zhilin Yang, Peng Qi, Saizheng Zhang, Yoshua Bengio, William Cohen, Ruslan Salakhutdinov, and Christo- pher D Manning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:14.704610Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:92ad35dc41d3383f6bb8f0ea8516bfc9cbb2554b45e52a0922ce09b9bc356218","observation_id":"61cb4f7a-2833-4d5b-b1f6-f3659f8cb6ed","resolution":{"observed_at":"2026-08-03T09:33:14.704610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:33:15.124755Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:15.124755Z"},"links":{"citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:18e93f335f3db079ffd27f67508234580e189a196b1de972184a8bc725361edf","observation_id":"30a2c15a-76bd-437c-8f33-00633af7694c","resolution":{"observed_at":"2026-08-03T09:33:15.124755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:33:15.230764Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:15.230764Z"},"links":{"citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:e22a1c7b9f733a5b991e489eb348ee024ddc9bb6b17d5c484fd9f7de1065cbe9","observation_id":"b0258e07-98e9-4c8a-89f0-df89dd295869","resolution":{"observed_at":"2026-08-03T09:33:15.230764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-03T09:33:14.360591Z","title":"Qiwei Di, Kaixuan Ji, Xuheng Li, Heyang Zhao, and Quanquan Gu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:14.360591Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:043d1804ac06b810b80b95480928e16a5da26a9f65fa0d210805f9ba835d0f03","observation_id":"be6a9301-f5cf-4ce7-a1b8-1999e448a798","resolution":{"observed_at":"2026-08-03T09:33:14.360591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08124","last_updated":"2020-07-16T05:52:16Z","snapshot_observed_at":"2026-08-10T13:06:17.421919Z","submitted_at":"2020-07-16T05:52:16Z","title":"LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08124","snapshot_observed_at":"2026-08-03T09:33:14.464964Z","title":"InThe Twelfth Inter- national Conference on Learning Representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:14.464964Z"},"links":{"cited_paper":"/paper/2007.08124","citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:66a14d76259d731b85dd7969877a3f910eaea8e361427e01e8bcad69a13390e2","observation_id":"aab0740c-8623-4f61-8621-6b65062e2cc5","resolution":{"observed_at":"2026-08-03T09:33:14.464964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:33:14.395571Z","title":"Takeshi Kojima, Shixiang Shane Gu, Machel Reid, Yu- taka Matsuo, and Yusuke Iwasawa","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T09:33:14.395571Z"},"links":{"citing_paper":"/paper/2601.13735"},"observation_digest":"sha256:b7b793b9e24b0f05ee5b42f3d92c250065625be6f8cc5f23b9242e4a35b0c551","observation_id":"ba530d23-7f84-4ff1-ab3b-0c03622d7e35","resolution":{"observed_at":"2026-08-03T09:33:14.395571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.13735","last_updated":"2026-06-03T09:26:48Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T23:28:44.495007Z","submitted_at":"2026-01-20T08:46:33Z","title":"Reasoning or Fluency? Dissecting Probabilistic Confidence in Best-of-N Selection"},"reference_resolution":{"displayed":10,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":10},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 10 of 10 outbound references and 1 inbound Pith citation observation for arXiv:2601.13735."}