{"as_of":"2026-08-11T00:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a07fa1bd7f5efc9251c9d2b2ae8bc0928dcdb995901339bc2b374a9fdb7cefa0","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:50:52.589230Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06877/citation-record","integrity":"/paper/2506.06877/integrity","json":"/paper/2506.06877/citation-record.json","paper":"/paper/2506.06877"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.809686Z","title":"- For n = 1: (21 − 1)(31 − 1) = (2 − 1)(3 − 1) = 1 · 2 = 2 Since 2 is not a perfect square, n = 1 is not a solution","venue":null,"work_id":"91f155f5-2e3d-4a75-8166-1ab42632c0cc","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.721082Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:9d82d3d313775005cfd1b3c7ab8d6a26907a577e666a21c91cc77262a5202a0f","observation_id":"c0ffd5a8-9653-4055-bf8c-fc097a49193c","resolution":{"observed_at":"2026-08-07T05:50:58.815811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.789849Z","title":"Then A · B = m2","venue":null,"work_id":"fc22acc7-73f0-4927-8732-633c2564fa02","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.814187Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:b859876964ecaad4770ec0c9877da3edd733fdcb705b6d4a73f0fc1bd96fa630","observation_id":"bf2401fd-78dd-4c80-af59-37c836414f9c","resolution":{"observed_at":"2026-08-07T05:50:58.796164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-10T17:02:50.054809Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T05:50:49.397263Z","title":"arXiv preprint arXiv:2412.19437","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.397263Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:6a12bea091bbe9f3e262a000a5b36aebd5e1cac52bf13692b824c7f91786f340","observation_id":"d40f91b3-e126-439c-b9a1-f1761660bd8d","resolution":{"observed_at":"2026-08-07T05:50:49.397263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13076","last_updated":"2024-04-15T16:49:59Z","snapshot_observed_at":"2026-08-10T14:31:26.003437Z","submitted_at":"2024-04-15T16:49:59Z","title":"LLM Evaluators Recognize and Favor Their Own Generations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13076","snapshot_observed_at":"2026-08-07T05:50:49.513946Z","title":"Preprint, arXiv:2404.13076","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.513946Z"},"links":{"cited_paper":"/paper/2404.13076","citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:de3abbb71fea0368e277144c0e56690017e33ff0527df973ee122843ca16c72c","observation_id":"e104101e-e157-47ab-9789-edbe58235f57","resolution":{"observed_at":"2026-08-07T05:50:49.513946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21934","last_updated":"2025-09-04T19:36:32Z","snapshot_observed_at":"2026-08-10T14:03:54.726131Z","submitted_at":"2025-03-27T19:21:05Z","title":"Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21934","snapshot_observed_at":"2026-08-07T05:50:49.653031Z","title":"correct answers via flawed reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.653031Z"},"links":{"cited_paper":"/paper/2503.21934","citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:ebf9a09692f8fe989bed08861512b61bd829ac98d7d47a0bd47141d473f93f86","observation_id":"b12c2113-dbc3-4f3b-bc7e-d081fa75d0cf","resolution":{"observed_at":"2026-08-07T05:50:49.653031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:57.554920Z","title":null,"venue":null,"work_id":"c2d56449-3e9b-465a-9345-1ec3102d93a6","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.604207Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:4c2bbaf55206c988d53c5de12c8144662d0b7557c3be61d93abcee0a7a23a80d","observation_id":"014abebb-2fdf-47f5-bc04-04ebbe0dca09","resolution":{"observed_at":"2026-08-07T05:50:57.716737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:57.125446Z","title":null,"venue":null,"work_id":"c0dc2526-77b3-43e5-99f4-935e1df024c7","year":2016},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.701487Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:0e3c2c1bfc4aa246368765d1d12973a19d45a16b73efe75cd32a69d99868f9ff","observation_id":"5b9a4e03-f542-4d12-93dd-ee10dfbb1637","resolution":{"observed_at":"2026-08-07T05:50:57.305382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.770261Z","title":null,"venue":null,"work_id":"7d863880-fa01-4a05-8da7-f35f6e74f11d","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.907490Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:16d5959165ab2e277dcdb9b02152fed993ea09059711e659e17c12e5d970e12a","observation_id":"fd780392-8395-4b35-b06a-a35cd21a1e5c","resolution":{"observed_at":"2026-08-07T05:50:58.777450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.747923Z","title":"Here, a + b + c = 3 and ab + bc + ca = 3, which satisfies the given condition","venue":null,"work_id":"ad606e31-5176-4635-b8c4-8f02e7853a22","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.992869Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:edc64f29692319a5fc1c170b1f2fee9c8ace3e067a5ee1ec3450b031c58c1eb4","observation_id":"07602c5b-5dc9-414b-9b3e-64a282e323ca","resolution":{"observed_at":"2026-08-07T05:50:58.753465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.727496Z","title":"The condition a + b + 0 = ab + 0 + 0 simplifies to a + b = ab","venue":null,"work_id":"bde05537-88d1-4f8f-904f-3e633d78becf","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.054915Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:00d9508182d00a57320c79e63fd3a38ece3a1b7202610ab5340df267734c5155","observation_id":"faf7d601-2cd0-4203-b353-46b01b3735a6","resolution":{"observed_at":"2026-08-07T05:50:58.735991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.699836Z","title":"For instance, if we take a = 1.5, b = 1.5, and c = 0.375, the inequality still holds for k = −3+ √ 13 2","venue":null,"work_id":"36ef73d3-73cf-4903-8f3e-b89695de839d","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.137795Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:da5d657885a683bd9ab47a5251deb6c5a8e863e14e38dca79c5bff678a1a3a87","observation_id":"dd6edfbc-b5f5-41fd-b906-a909b66e024a","resolution":{"observed_at":"2026-08-07T05:50:58.711178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.670469Z","title":"- Place E at (3, 0) since AE = 3","venue":null,"work_id":"f5dc7e28-2dd1-4ce1-814b-413485d17d15","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.221065Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:d583871c1bba966076d169e69d3381ed07f9e152733e3c75b652bf1233739242","observation_id":"9c4fa524-a07c-40ab-9148-de18db3cb993","resolution":{"observed_at":"2026-08-07T05:50:58.679150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.653273Z","title":"Let AC = x","venue":null,"work_id":"fe63cfc5-5c30-4777-a71c-ac9d255201ef","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.301770Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:5e714b9a8eb9711351657da338535a8bdceda526f2bc20915d9e18007309d8ce","observation_id":"a1c6314a-986e-4d59-973b-a4f141a452dc","resolution":{"observed_at":"2026-08-07T05:50:58.657511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.637441Z","title":"The coordinates of D are given by: D = 5 · c_x + x · 3 5 + x , 5 · c_y + x · 0 5 + x where C = (c_x, c_y)","venue":null,"work_id":"5f0adef7-fb2d-4be6-8eb9-828b0164b90d","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.387432Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:48d4c66f0dbc9be75a515ea424e6ae6f06e0f4dd759573e8218b923759d4a3b5","observation_id":"e56727e8-ec6b-4fe0-8707-2e782bb11311","resolution":{"observed_at":"2026-08-07T05:50:58.642103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:58.372203Z","title":null,"venue":null,"work_id":"77dead53-1f12-4826-93e7-e37a980c8554","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.468976Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:79543fc51c991e3f7e3bbadd7c649935fa97e58b03c4ab53639e3bed9750879f","observation_id":"86dc26a5-da7a-43e4-941a-da904bf9c723","resolution":{"observed_at":"2026-08-07T05:50:58.559012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:57.942780Z","title":null,"venue":null,"work_id":"f63e00de-6b5c-41b9-968a-938d40324649","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.543248Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:251d4cbb6565d5c449e811d7868ec2998bae6d368db10447d5b01cdfde1e0f32","observation_id":"f6bb27b5-430a-4f9f-9367-8bdd1176d4c9","resolution":{"observed_at":"2026-08-07T05:50:58.191135Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:56.811191Z","title":"This simplifies to 8ax + 16a + 4b ≤ 2x + 2","venue":null,"work_id":"fa6c47c4-6ba7-4f88-ba69-1987748288ea","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.784552Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:a0ebbe9d97bd7f2f997f2e10e5c1a93a5e858a14104a6ece58da6890cc146201","observation_id":"55aeae37-b152-403a-9373-1abc62579bf7","resolution":{"observed_at":"2026-08-07T05:50:56.911498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:56.516640Z","title":"This simplifies to 24ax + 144a + 12b ≥ 6x + 30","venue":null,"work_id":"976d2737-31f7-43e8-8b87-fc49d716bb75","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.873567Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:55b78ebdb381a749b0ac0b21b8e4d56503698c153234c163ceb94e9420610dde","observation_id":"289c1374-d442-4030-9cec-cbe024d6c7d7","resolution":{"observed_at":"2026-08-07T05:50:56.627631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:56.328660Z","title":"Therefore, the function is: f (x) = 1 4 x2 − 1 2 x + 1008","venue":null,"work_id":"64496ad5-d24f-4346-ad01-6d9de64d8994","year":2016},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:50.952091Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:197cfdffdf2abc0e1a39f95b8f6e6815fd7a9923675d1fdf68a2f096790c6d02","observation_id":"7d4e40ab-da9c-4bc0-9168-0d4d3059e39a","resolution":{"observed_at":"2026-08-07T05:50:56.396319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:56.110252Z","title":null,"venue":null,"work_id":"9566868d-c5de-4354-aa75-389f2cdc4342","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.026797Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:508b4ddd127a8e88bc0c76d2042f2c028e128f1b109a089fd5dc5e660b44a310","observation_id":"9454a065-9de6-424e-8d77-e73dee526392","resolution":{"observed_at":"2026-08-07T05:50:56.211585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:55.936925Z","title":null,"venue":null,"work_id":"413e3732-0d19-4cde-9b30-560a78241a84","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.147449Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:1f30ec0afeaf3bd603c9f676971ec483ecdcdc15470a2f53afcf3b0f2634a143","observation_id":"6f242a36-863c-48e6-be22-eebf87ada026","resolution":{"observed_at":"2026-08-07T05:50:56.016861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:55.757212Z","title":"These roots satisfy the sum of roots being 0 and the sum of the products of the roots taken two at a time being -10, which matches the conditions","venue":null,"work_id":"d1ed8019-4bbd-404f-94b0-f81db3c12d20","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.281290Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:0ac89b1f0750949e33a1e16d83a276caf7d8128ff1f0a75208936a6f7aab9748","observation_id":"d3613f5b-b374-4b9a-ae9a-c1f7bbe40792","resolution":{"observed_at":"2026-08-07T05:50:55.841160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:55.551094Z","title":"Discriminant analysis shows that a larger m cannot be constructed","venue":null,"work_id":"31c855c7-87da-4c2a-8115-fee945368a50","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.389827Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:babe0fa4caa4da346d969742b9351f96f866afc7a52d3d746cdc17ad2bd84381","observation_id":"fb00a21a-5873-4ac6-92ff-a9efe1bc070e","resolution":{"observed_at":"2026-08-07T05:50:55.633729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:55.410223Z","title":"We can also verify the result by solving for the general formula of the recurrence relation","venue":null,"work_id":"de6dda48-811a-4e85-993b-843685ca730d","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.557642Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:ec220872407c482881b8adb06946d31d818c41486208f8d794830f3796d12841","observation_id":"0aa2b747-7e29-4bb0-b744-4e68cdd007a9","resolution":{"observed_at":"2026-08-07T05:50:55.453832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:55.256889Z","title":"The left side, sin(πx), also has a period of 2","venue":null,"work_id":"7c38261b-cd21-49ac-a81a-fc2206f4d5cb","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.670459Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:445a52638399192d5bb6341f9acd1e26b899fd47bd8e37c3f232bf18e497db4f","observation_id":"b6aa4ce1-474e-4615-ac2d-6529602585b9","resolution":{"observed_at":"2026-08-07T05:50:55.308672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:55.060403Z","title":null,"venue":null,"work_id":"3c58987b-ad99-48d6-b3fd-cc1e3419b717","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.726793Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:67bf8d1558414f8b17ce23c2312bbecbcf8584354d2b3717346a8d2c7acc3b82","observation_id":"be5347b0-2237-4fb2-a614-97af45307c06","resolution":{"observed_at":"2026-08-07T05:50:55.138238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:54.894131Z","title":"Let x = 2k + t (where t ∈ [0, 2))","venue":null,"work_id":"f0fc82db-229f-4732-a311-6baf0b32abf9","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.798806Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:3d4d15644dc5f1af0751982641f9c366e9188cfda438ca955b72861c409ec676","observation_id":"d0e9b299-f5b5-417b-8b47-358514efe451","resolution":{"observed_at":"2026-08-07T05:50:54.961296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:54.676346Z","title":"Therefore, the sum of the corresponding x solutions is: (2k + t1) + (2k + t2) = 4k + (t1 + t2) = 4k + 1","venue":null,"work_id":"c311310d-eb1c-4880-9829-961d06206009","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.879846Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:8fee85b8e4a14a4915d940a838fe284e8491c05b02ccf30a6d40c338d9397334","observation_id":"4bef746c-19e8-428c-bd49-d331e936f3c1","resolution":{"observed_at":"2026-08-07T05:50:54.788106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:54.483262Z","title":"— **Final Answer** 12 C.3 IMO Case Study – IMO: Inequality Manipulation Errors Problem Description: Let R>0 be the set of positive real numbers","venue":null,"work_id":"6039dc84-bb4f-43eb-bb45-98baa1b75d60","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:51.973032Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:5aec33a4d62b249f9c4f737c6382e429c674f02c1179d5f03319e5640112a4b4","observation_id":"1761d0af-0f83-4dd7-9127-4642b0139f21","resolution":{"observed_at":"2026-08-07T05:50:54.584236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:54.263082Z","title":"- Simplifying both sides by dividing by f (x) + f (f (x)) (which is positive), we get: x ≥ f (f (x))","venue":null,"work_id":"cae89841-f551-4fd5-ae72-b0dc36d4e0fb","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:52.060924Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:82b902532d2b2caf80205ef8f9f007cda471e7930c180a1ceaf1818e4a34edd9","observation_id":"6c5d672d-aaf0-4d0e-94e9-c5340ab04cbc","resolution":{"observed_at":"2026-08-07T05:50:54.379042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:54.082335Z","title":"- Simplifying both sides by dividing by f (y), we get: f (f (y)) + f (y) ≥ f (f (f (y))) + y","venue":null,"work_id":"2cf8f990-0cb1-40e5-8e5f-a2df47c50846","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:52.123167Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:7200707271f27e1df719634b6896ca31b23bc3b63d48bc091b2fba49d515ee92","observation_id":"694f994e-7e1b-4c85-a90a-9743c07870df","resolution":{"observed_at":"2026-08-07T05:50:54.164443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:53.928102Z","title":"Combining these, we conclude: f (f (x)) = x - This shows that f is an involution, meaning f (f (x)) = x for all x >0","venue":null,"work_id":"6bdc6fc7-b4a2-424e-a451-be134d20e105","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:52.172033Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:bbd0eaba65da6a3776ae5ffcc3d19b6c18e6ccd9b5408c9b31ed17121e5ea9ed","observation_id":"51a5b865-8fcf-423c-b573-5ff221bd95c5","resolution":{"observed_at":"2026-08-07T05:50:53.988984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:53.722695Z","title":null,"venue":null,"work_id":"ad342141-711f-4af1-a832-c1ba193711c4","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:52.221318Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:888d8a230cf44d02262d79d79728b878574d07d4030cd1c82d03bfa20c1deb2a","observation_id":"d7514281-8653-48ee-97cb-f5481e65009f","resolution":{"observed_at":"2026-08-07T05:50:53.828655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:53.575615Z","title":"similar contradictions arise","venue":null,"work_id":"f37fb65c-b601-4ec1-970b-0e6cf6ea1b94","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:52.290953Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:3c5b286926781f7d99070da20c970e83cfcc4c1309bd6bf26e966d08d9e43743","observation_id":"9c273267-f51c-4c7d-9b70-3b4eb9ad90a8","resolution":{"observed_at":"2026-08-07T05:50:53.641272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:53.427169Z","title":"- p = k2 − 1 = (k − 1)(k + 1)","venue":null,"work_id":"1b344c8d-60ec-41ab-9b80-524a7e6e69f2","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:52.368175Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:d318949943555a37f84bf1361dac6144b2da62ac1e6570240d55a12572fd96e6","observation_id":"6668bfe9-d5a4-4214-a8d6-417590bf2b7a","resolution":{"observed_at":"2026-08-07T05:50:53.498411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:53.244747Z","title":"- Factoring: (k − p)(k + p) = 16","venue":null,"work_id":"6c318080-12d1-4f4e-8080-741f48f6f6f7","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:52.434280Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:bf63933cf4cdc0b44ce9baefbb51053fd1d4418e7cd5e3d5940ab79117f51fa7","observation_id":"3ad56bfd-fd89-4ef7-8318-ce85c9bb3218","resolution":{"observed_at":"2026-08-07T05:50:53.326381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:53.111820Z","title":"- This factors as 34 · (32 + 24) = 81 · 25 = 452","venue":null,"work_id":"0d4b9539-7ca8-4ce7-a514-bca34e35d61d","year":2025},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:52.497384Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:00e0477bbc085226f58e65db549ca041f5059b38ab2c924bf5bf2a63c4482750","observation_id":"6ece6ff5-4395-4e32-a5f5-b4d7135aa932","resolution":{"observed_at":"2026-08-07T05:50:53.169137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:50:52.965019Z","title":"- This factors as 38 · (3 + 1) = 6561 · 4 = 1622","venue":null,"work_id":"e615e86c-3a19-44c8-a1be-7add50145124","year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:52.589230Z"},"links":{"citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:d43e5a36edbe116b66eff3fdfdc5cf683df23812976233833ca33d6bc7df3192","observation_id":"8d4459b3-f778-42b8-925d-a1987daaf1ec","resolution":{"observed_at":"2026-08-07T05:50:53.038669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-08-07T05:50:49.311179Z","title":"Preprint, arXiv:2412.05579","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.311179Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:11c996e16f6ad7197946e616280e9f5e57624e1b495903d658b3d9995d2be956","observation_id":"2a9535f2-ad84-43ff-aad2-9dc73c1ddeef","resolution":{"observed_at":"2026-08-07T05:50:49.311179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T05:50:49.203073Z","title":"Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Ruoyu Zhang, Runxin Xu, Qihao Zhu, Shi- rong Ma, Peiyi Wang, Xiao Bi, and 1 others","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T05:50:49.203073Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.06877"},"observation_digest":"sha256:21ce8d24b93877defdeffbda1aa556785c1e88e4b685bf356977ed071768b5e7","observation_id":"ade5b51c-9d19-431a-80a4-3a90f6739eeb","resolution":{"observed_at":"2026-08-07T05:50:49.203073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06877","last_updated":"2025-06-24T13:55:38Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T14:04:37.338951Z","submitted_at":"2025-06-07T17:54:56Z","title":"Right Is Not Enough: The Pitfalls of Outcome Supervision in Training LLMs for Math Reasoning"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2506.06877."}