{"as_of":"2026-08-10T02:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:94986bb76fea2dea9f4a7987ab7e470066dacccb6efece83c21bfdbe5189c8e2","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:33:40.054182Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14852/citation-record","integrity":"/paper/2505.14852/integrity","json":"/paper/2505.14852/citation-record.json","paper":"/paper/2505.14852"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:43.010471Z","title":null,"venue":null,"work_id":"3ee0b306-8fc4-4e4a-87dc-3cedddb5554c","year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.469868Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:638c8fd768ecff4a7eb244a8cacf65035f7903dc76b51cfb1303e6b0f86db4b4","observation_id":"90faacad-de6a-4a6e-894a-f6e2422b6dda","resolution":{"observed_at":"2026-08-07T15:33:43.092798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-07T15:33:34.591326Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.591326Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:fc3e6b270aa91a2cd6145ef80cd97187a3c80eba28281b2d478f3a144382f073","observation_id":"a565356e-2b37-4f57-8bcb-f657075dca0a","resolution":{"observed_at":"2026-08-07T15:33:34.591326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08347","last_updated":"2024-12-11T12:41:36Z","snapshot_observed_at":"2026-07-06T20:05:14.412418Z","submitted_at":"2024-12-11T12:41:36Z","title":"SmolTulu: Higher Learning Rate to Batch Size Ratios Can Lead to Better Reasoning in SLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08347","snapshot_observed_at":"2026-08-07T15:33:34.734735Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.734735Z"},"links":{"cited_paper":"/paper/2412.08347","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:b5347a006e5c453ddadd325d800c1d670f4ac4f0f92dd78f3faf62b505a7f676","observation_id":"d377918b-737e-48d9-8599-931c22b54de2","resolution":{"observed_at":"2026-08-07T15:33:34.734735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:34.839055Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.839055Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:e8933f7775d5f23f5390481e125d908cba158b91a1cd03985198edf41cc10072","observation_id":"76b9f612-9f93-44f5-97f4-69ee24fba3dc","resolution":{"observed_at":"2026-08-07T15:33:34.839055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-08-07T23:49:29.478548Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-08-07T15:33:34.990367Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.990367Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:2b3b47d3c7231c4422b09eb07d125897f85d7c0a4ceeb0c1c69eac5389752c1f","observation_id":"ffe08e67-6ea9-4548-81e5-1c48b9f14946","resolution":{"observed_at":"2026-08-07T15:33:34.990367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:35.139266Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.139266Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:ade51e6d1c8bd641102ea7c15b9af5022bc509156c85d29d118cc41a3ff9fd17","observation_id":"ba7054e5-3cb9-487b-aa64-500e8541786b","resolution":{"observed_at":"2026-08-07T15:33:35.139266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T15:33:35.241541Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.241541Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:039e365303a7c6d8b15eeefab5fe55bb952b335b62352bcfca5526803c5a73ed","observation_id":"33ec6601-6d10-430c-b848-8b1abfe03db9","resolution":{"observed_at":"2026-08-07T15:33:35.241541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:33:35.354510Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.354510Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:a9bafa71c3928011eb38006065b7a2e4cd6760f1f3e6ad1c7ddb785ac853155d","observation_id":"6f364498-8928-4be2-9e6c-ded476879f25","resolution":{"observed_at":"2026-08-07T15:33:35.354510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:33:35.492369Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.492369Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:84cfaefbd5d5c91f0d354849b3f6972dbed730a0963e352309cd7ef6a4b42483","observation_id":"0dad5c8c-6391-402e-8b5f-0d2d5a6f3764","resolution":{"observed_at":"2026-08-07T15:33:35.492369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:35.632260Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.632260Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:194abc1a604992f0008b440f0274bcc681f8a74dd4e5975b0df83d3047e03f3a","observation_id":"7f9d406d-0364-4881-b5c0-449430461f92","resolution":{"observed_at":"2026-08-07T15:33:35.632260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:42.783775Z","title":null,"venue":null,"work_id":"ee79f9a7-9a09-491c-8f87-99f82c11ccee","year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.749721Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:b2c21abed556947526db7ddc76dc5bb1e1d01ef40c529b5c599423729ed0b04c","observation_id":"0646abf8-6c3b-455d-9d75-48f7e4a3ec00","resolution":{"observed_at":"2026-08-07T15:33:42.891359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07647","last_updated":"2024-04-11T11:10:36Z","snapshot_observed_at":"2026-07-06T17:58:47.786948Z","submitted_at":"2024-04-11T11:10:36Z","title":"Why do small language models underperform? Studying Language Model Saturation via the Softmax Bottleneck","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07647","snapshot_observed_at":"2026-08-07T15:33:35.873061Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.873061Z"},"links":{"cited_paper":"/paper/2404.07647","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:0d472d9d119e56558e3ca4da8a517878c89c41d21cf196b16f09cc9b97dd99e1","observation_id":"52cbf95b-fe71-4410-93b3-355dcd598466","resolution":{"observed_at":"2026-08-07T15:33:35.873061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T15:33:36.629741Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:36.629741Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:c9b9213bdd9f572d792804a1676560b04e71172ee050e3c3cf4e8f718aa61b42","observation_id":"875eb6c7-77d2-4f50-ae3e-adc6258a03ab","resolution":{"observed_at":"2026-08-07T15:33:36.629741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T15:33:37.175443Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.175443Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:1ee6ec42f7299cbc1fed2934987f7c72a149e0611df92933ab1d305cd3b308e6","observation_id":"10b92260-0f6c-4c7f-8ce7-88f20971cff0","resolution":{"observed_at":"2026-08-07T15:33:37.175443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12393","last_updated":"2024-09-19T01:34:43Z","snapshot_observed_at":"2026-08-06T18:37:15.578000Z","submitted_at":"2024-09-19T01:34:43Z","title":"Small Language Models are Equation Reasoners","version":1},"cited_work":{"arxiv_id":"2409.12393","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.12393","snapshot_observed_at":"2026-08-07T15:33:40.556734Z","title":"Small Language Models are Equation Reasoners","venue":"cs.CL","work_id":"dc625f54-696a-465c-8ce4-f89b677bfff9","year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.277665Z"},"links":{"cited_paper":"/paper/2409.12393","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:de14c3863c236ef37eb285d6fecf3bf50b01f2e02e756c8fe57351d928d3aff4","observation_id":"516bf4ce-a250-4a5d-94c7-97455811903a","resolution":{"observed_at":"2026-08-07T15:33:40.659636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-07T04:02:08.445660Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-07T15:33:37.378908Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.378908Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:2a8511a7bd1261d32663233437fa0853eaae64109b50466f25d0140e409061b8","observation_id":"d5d1d6f8-432b-406d-94d9-91678f5f5330","resolution":{"observed_at":"2026-08-07T15:33:37.378908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:37.486978Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.486978Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:fe345824acce31655cb5970abdf7d616995ec7e6954f42ba2850df010731a58f","observation_id":"33cbc24f-b11d-4147-9293-9bdef445c17f","resolution":{"observed_at":"2026-08-07T15:33:37.486978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-07T15:33:37.553937Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.553937Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:604c21a4ed15b0940ae6dd04d74cbc2deabd8484a8bb4216984e1e17e3f27f8c","observation_id":"8c4ccdee-c447-4b73-8fb8-1de0f632c685","resolution":{"observed_at":"2026-08-07T15:33:37.553937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15084","last_updated":"2025-01-17T07:12:55Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:29:44Z","title":"AceMath: Advancing Frontier Math Reasoning with Post-Training and Reward Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15084","snapshot_observed_at":"2026-08-07T15:33:37.634222Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.634222Z"},"links":{"cited_paper":"/paper/2412.15084","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:75bfc0aa20da8a1402f437d780b297f61e3a6b6085bef5f0832ffcd6a4dd5018","observation_id":"a15bbb19-5bf1-4a84-b846-63bc33d71447","resolution":{"observed_at":"2026-08-07T15:33:37.634222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:42.493404Z","title":"Tang, Manan Roongta, Colin Cai, Jeffrey Luo, Tianjun Zhang, Li Erran Li, Raluca Ada Popa, and Ion Stoica","venue":null,"work_id":"42fb4840-8cfa-4d3b-9e2f-090fbe338e37","year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.735513Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:b8f77174dff2dcd0df86cf7c644326d92334c6c89b7ccdcb7c5b4f8574d09398","observation_id":"ed68e050-b62c-457e-99f4-10131f0d9a72","resolution":{"observed_at":"2026-08-07T15:33:42.614619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:37.871657Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.871657Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:964485e9b8b80750963148a9228795178103c0206c4b5f4d089badf5cfacef99","observation_id":"947b9b6e-5d77-4502-adac-160122208733","resolution":{"observed_at":"2026-08-07T15:33:37.871657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:37.983486Z","title":"Smith, Mateusz Paprocki, Ond r ej C ert\\' i k, Sergey B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.983486Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:197c8153077c88b05b7611ee568ede61a0c0bb11130dfff1bc9f4ec39f64bd40","observation_id":"ed060ce2-7340-4389-a9c0-ca72d51e99fd","resolution":{"observed_at":"2026-08-07T15:33:37.983486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-07T15:33:38.090090Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.090090Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:bace2ad6c93c3d7965b534182c77709c6fe964eeb8e73cfdbe3b05b5de9cb5a7","observation_id":"7640b833-2cea-4df8-9c5c-22f5d204ca49","resolution":{"observed_at":"2026-08-07T15:33:38.090090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14830","last_updated":"2024-02-16T23:44:38Z","snapshot_observed_at":"2026-08-01T01:16:04.260529Z","submitted_at":"2024-02-16T23:44:38Z","title":"Orca-Math: Unlocking the potential of SLMs in Grade School Math","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14830","snapshot_observed_at":"2026-08-07T15:33:38.212486Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.212486Z"},"links":{"cited_paper":"/paper/2402.14830","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:52316bf1907eb5955fd40946a4b3c36d56860ec4ab3e8e1726f6ae806812f038","observation_id":"5957711c-016b-44aa-9c2f-4b9be5d64618","resolution":{"observed_at":"2026-08-07T15:33:38.212486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:33:38.344953Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.344953Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:ed48001b48ddf061b07f94b874d5d1f6d4f6c870357092a1a15c76b763e249bb","observation_id":"148b9d02-ea88-4b10-8076-0ba90c616ba9","resolution":{"observed_at":"2026-08-07T15:33:38.344953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:42.179717Z","title":null,"venue":null,"work_id":"f00c4f5f-6f48-4083-bdd7-8c2d36254feb","year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.478698Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:9c6f7ba4c0754c45754bb1fb41a0f7d7c7bc497f48806b03b31c1a413ab7ff7d","observation_id":"6c6a137b-c7aa-40a3-9a95-492e6ecddc02","resolution":{"observed_at":"2026-08-07T15:33:42.345896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06608","last_updated":"2025-02-26T18:59:01Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-06T18:10:11Z","title":"The Prompt Report: A Systematic Survey of Prompt Engineering Techniques","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06608","snapshot_observed_at":"2026-08-07T15:33:38.633083Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.633083Z"},"links":{"cited_paper":"/paper/2406.06608","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:15d48cf0e6d65ba1e0778c6d58fa9d27f4f50a05864e89c15a091a7ec7232cb1","observation_id":"7a141da2-b4ab-48e2-a8a7-7026c7fcb4f5","resolution":{"observed_at":"2026-08-07T15:33:38.633083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:38.769960Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.769960Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:9de696d576d0189e48cadf27a17ef5617222a92d96410ddeeee553ebc745471f","observation_id":"986be034-7e93-4ade-b3ba-aad732d171cd","resolution":{"observed_at":"2026-08-07T15:33:38.769960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:41.846971Z","title":null,"venue":null,"work_id":"a83f8aa6-fc7b-454d-80f0-462860927f73","year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.892189Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:ed1fdcabb4c0482360ec406cc4876222bd9a61160ebe0d958b5caa30fa587b4a","observation_id":"a2178cdb-e543-4f74-81af-9014fa6d2633","resolution":{"observed_at":"2026-08-07T15:33:41.999157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-08-07T15:33:39.064313Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.064313Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:8e221961cd50c8eb1f6ceec853a81c39c14d1c7993699f9f953fe8ca1eb57c36","observation_id":"afce4c83-1dbc-448d-82ba-b27682fe53ec","resolution":{"observed_at":"2026-08-07T15:33:39.064313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T15:33:39.197297Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.197297Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:c118f7c3e504b27ea47e2cfdced02c3c19d18842b8c10e34626a7b0de3a5eaa6","observation_id":"d242bde7-67b3-4d7e-8b7f-815bb20c405d","resolution":{"observed_at":"2026-08-07T15:33:39.197297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:41.534861Z","title":null,"venue":null,"work_id":"64d9f8b9-abac-4cd8-a9a3-93d7a3e371c8","year":2022},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.309003Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:720d9fa5cf3ec5cdd46eefbad017fb5ae6be2840d385b70967204a404c5fd04b","observation_id":"dda988bc-f105-41ad-b6d0-14106b9868a1","resolution":{"observed_at":"2026-08-07T15:33:41.710632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T15:33:39.413606Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.413606Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:3f769413b28072ca91ae3f3f764160b17167db1806be4a7dcf3e64f6fd44902f","observation_id":"3ad32bed-7a73-4912-b2b7-842e074ad359","resolution":{"observed_at":"2026-08-07T15:33:39.413606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17974","last_updated":"2025-01-31T16:06:26Z","snapshot_observed_at":"2026-07-06T20:28:09.807683Z","submitted_at":"2025-01-29T20:20:48Z","title":"Think Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17974","snapshot_observed_at":"2026-08-07T15:33:39.589453Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.589453Z"},"links":{"cited_paper":"/paper/2501.17974","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:15fd13c53165f68b4ea071db145f967a83508830daaf2c604d69f5ecf6e12398","observation_id":"a7819084-3c02-4d22-af5d-ad91db41beab","resolution":{"observed_at":"2026-08-07T15:33:39.589453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:41.199204Z","title":"Yue, Lovish Madaan, Ted Moskovitz, DJ Strouse, and Aaditya K","venue":null,"work_id":"f575bd03-dd00-41b0-944f-969469ea1e28","year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.717760Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:f4a977a0532eafc9b0d027e1971f849522e28ba5678f593e4d65c9a11be0b143","observation_id":"7e7ea553-ba40-42d5-8d1e-44a4e087f678","resolution":{"observed_at":"2026-08-07T15:33:41.345809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:40.893578Z","title":null,"venue":null,"work_id":"51c46a2f-e51f-457e-921f-a89ab55e885e","year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.842697Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:8562b862c2c365d781c92c711d062e59033d16e0a3a9c64503d22bb835961347","observation_id":"1741a15c-c033-4885-9875-fa3fa3f21992","resolution":{"observed_at":"2026-08-07T15:33:41.022751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:39.955182Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.955182Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:b4d839e4aa65b66bdfaf435d0bbf256455cc621e6d5e37b98de484c8cd2a7b07","observation_id":"399838c1-f3f2-4451-be79-3c3ca68c1c5e","resolution":{"observed_at":"2026-08-07T15:33:39.955182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:40.054182Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:40.054182Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:c4cb9ddbc6a2edc1816eff9e3bc02136bfcb0f1fe922ed4e0dc221973809e082","observation_id":"d91681eb-cebd-4f0b-b0b2-3cc71d4e0111","resolution":{"observed_at":"2026-08-07T15:33:40.054182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T01:53:57.880414Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2505.14852."}