{"as_of":"2026-08-10T11:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56b9b59ebdc0621cd38aa252180a0240bacc430107f897ef79e3753b8f67a59c","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:01:28.538533Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18915/citation-record","integrity":"/paper/2607.18915/integrity","json":"/paper/2607.18915/citation-record.json","paper":"/paper/2607.18915"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:27.169689Z","title":"To find the proper divisors of284, we first factorize284","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:27.169689Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:e1fab5c28113e8ae1c064d2027c74b8923e451fd4b60e18fcb517654c845f227","observation_id":"b74c9278-23fa-4a1b-be4b-457c1df769ce","resolution":{"observed_at":"2026-08-01T14:01:27.169689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:27.423708Z","title":"Now, we need to find the sum of the proper divisors of220","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:27.423708Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:884c50f8100825884f88880246650051ee5ac61c487bbe9d8408b50405f3ed24","observation_id":"1cc76e3f-e408-4216-8007-803534f9e091","resolution":{"observed_at":"2026-08-01T14:01:27.423708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-01T14:01:26.698001Z","title":"Sebastian Farquhar, Jannik Kossen, Lorenz Kuhn, and Yarin Gal","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:26.698001Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:183ff81d4182822297324d4c46815eea7ab51959cc6c7aefb72ec056092c1287","observation_id":"ce641363-21b9-4ea8-bad1-745c5a3ba5be","resolution":{"observed_at":"2026-08-01T14:01:26.698001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11747","last_updated":"2023-10-23T01:49:32Z","snapshot_observed_at":"2026-08-07T22:56:15.588770Z","submitted_at":"2023-05-19T15:36:27Z","title":"HaluEval: A Large-Scale Hallucination Evaluation Benchmark for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11747","snapshot_observed_at":"2026-08-01T14:01:26.820493Z","title":"inclusionAI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:26.820493Z"},"links":{"cited_paper":"/paper/2305.11747","citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:e4573b817dfa9c6f427459f5b1a86dfe2482fca6c17b50ef7f29b53d64dad58b","observation_id":"76f21532-3274-4787-8d51-d5a7ca7eb161","resolution":{"observed_at":"2026-08-01T14:01:26.820493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T14:01:26.939799Z","title":"Zhilin Yang, Peng Qi, Saizheng Zhang, Yoshua Bengio, William Cohen, Ruslan Salakhutdinov, and Christo- pher D Manning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:26.939799Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:7c3f264a209406e5ed8f92e528d0f084ae069ee991d232c76791615cc0813443","observation_id":"08d19938-b540-4603-b881-91d28faaf221","resolution":{"observed_at":"2026-08-01T14:01:26.939799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-09T17:49:59.281910Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-01T14:01:27.035947Z","title":"Weihao Zeng, Yuzhen Huang, Qian Liu, Wei Liu, Ke- qing He, Zejun Ma, and Junxian He","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:27.035947Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:1caff483373af67a2b966cf0d611a41eae0eacd36a25deabec52f9f8c8a01407","observation_id":"915d4965-0699-44e7-a84b-74a7ef59f8f4","resolution":{"observed_at":"2026-08-01T14:01:27.035947Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:27.624649Z","title":"hallucination localization/rewriting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:27.624649Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:486b4ce8fad7791edae6e5bb703dcac493c3285689cec3cda67c3f7614f44a0d","observation_id":"afa52c84-76b2-409b-b164-7fccaa817733","resolution":{"observed_at":"2026-08-01T14:01:27.624649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:27.774408Z","title":"Final Answer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:27.774408Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:9797156be4b258986712343ca61206f00e90a68cd7fa20b4a35b6b148a5b12f2","observation_id":"19648093-7860-4c0b-b063-5d6480a0d0ef","resolution":{"observed_at":"2026-08-01T14:01:27.774408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:27.936321Z","title":"earliest hallucinated sentence that directly affects subsequent reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:27.936321Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:282bafe7a16dd080600836d08f6c912410214bc4e24ae09bf6d0a7946cf1e236","observation_id":"38c10828-8f7f-4ade-9866-0343144c2776","resolution":{"observed_at":"2026-08-01T14:01:27.936321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:28.094384Z","title":"AB= 5 ” when “AB= 3","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:28.094384Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:6cbcdafbbc167cd355a33453570059dc94f2c8c6a856efc1b5239558c7fe18c6","observation_id":"1f42706c-c421-42ae-9e14-c50018b41055","resolution":{"observed_at":"2026-08-01T14:01:28.094384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:28.262600Z","title":"independently solvable","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:28.262600Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:6dcac59b63552b7ea71e7c72cee68ddf8a3e15c51606650ccdf2ec2bdb917ee6","observation_id":"a4ad66cf-fc4a-4670-8023-703b023a8d28","resolution":{"observed_at":"2026-08-01T14:01:28.262600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:28.419001Z","title":"other parts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:28.419001Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:cb15ecd3ce22c5afccfa29c05d537ec17a45ecdca4db10f7ada63651f80f2612","observation_id":"6a9de737-4d42-4ebc-905a-4fbe0f05d4c5","resolution":{"observed_at":"2026-08-01T14:01:28.419001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:28.526309Z","title":"sub-question is embedded in a larger context,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:28.526309Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:2c3e5a41570d79ac2c6d845b523149fd030e0e1576933e6882e7afcc23d89f2d","observation_id":"66e81966-4398-483a-977e-cec144b863ff","resolution":{"observed_at":"2026-08-01T14:01:28.526309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:28.530363Z","title":"Compute. . . /What is. . . ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:28.530363Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:06dfbcef33d041f6309edf39da7620b098b40b656f9db292b5267799c5173c85","observation_id":"653e9e83-5032-499b-9766-0f6c5cc54bb6","resolution":{"observed_at":"2026-08-01T14:01:28.530363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:28.534568Z","title":"seemingly related but actually irrelevant","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:28.534568Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:0721c4edc747bd92a5e6b0d6aef28a617dee6779ea483fe49a6e6ee0fa212f48","observation_id":"b0b198fa-7f42-4925-842e-c9c769d7d93a","resolution":{"observed_at":"2026-08-01T14:01:28.534568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:28.538533Z","title":"?” or English “?","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:28.538533Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:75db0ad3806e89f51140be7bb6892b1dc11b282de115be81511c98dd8c0e70ff","observation_id":"5bcd4c91-af85-4043-9753-a686aac16c9f","resolution":{"observed_at":"2026-08-01T14:01:28.538533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-01T14:01:26.579324Z","title":"Valeria de Paiva, Qiyue Gao, Hai Hu, Pavel Kovalev, Yikang Liu, Lawrence S Moss, and Zhiheng Qian","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:26.579324Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:bb712eab7f72614c6f30b72b5a4307d35d2ee0e82e3c92bd1b829e59c59443d8","observation_id":"d6d2e049-f600-4e93-88b8-115f838e0048","resolution":{"observed_at":"2026-08-01T14:01:26.579324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:01:26.522693Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:26.522693Z"},"links":{"citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:881466e27b04bbd9041cdf66fba0f07575aef55fc63e0b62f4bedc616527bd1d","observation_id":"b70ce718-a4fe-4164-b196-f9a779d1e0e6","resolution":{"observed_at":"2026-08-01T14:01:26.522693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:56:25.485439Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2607.18915."}