{"as_of":"2026-08-18T11:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f81ff657d978d0cc09bffb957ecbc54ae4c2226fc71e80ebce1de8d28f501f1d","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:38:28.303524Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.17665/citation-record","integrity":"/paper/2504.17665/integrity","json":"/paper/2504.17665/citation-record.json","paper":"/paper/2504.17665"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.159490Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.159490Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:888d34e20f304e45946e72c50cbba463be8f156a8b647a6058bc940b2ca0d051","observation_id":"62a960ec-5e32-450a-96d9-08c7fe067a1a","resolution":{"observed_at":"2026-08-16T10:38:27.159490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.256611Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.256611Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:f9b4b639272ef156ca115f4c2c645ff8f24db6c409ec1d5310fa048c3710084c","observation_id":"506503f3-8331-40a1-9a64-ba58128b6830","resolution":{"observed_at":"2026-08-16T10:38:27.256611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T10:38:27.277342Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.277342Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:130795ad2abe7f08f75d0e1695f331a7be0c5b6dc92e032128a2562df18a1b72","observation_id":"e79519a5-0baa-460e-a67d-5feeff3aba02","resolution":{"observed_at":"2026-08-16T10:38:27.277342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-16T10:38:27.285575Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.285575Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:d8faae58c6592295ca6f87e57a821c92924e36f3f94ed7bc238d1ebb18acf947","observation_id":"ff58524e-b33a-4208-8c31-6305b3699408","resolution":{"observed_at":"2026-08-16T10:38:27.285575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-16T10:38:27.305525Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.305525Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:6696e5eddd18b00f6454e0057dd59d1a0ef0010fe7be4bc9e60e81d0854b0317","observation_id":"dada4289-5d98-4b00-82b1-e2e86c9b2d3f","resolution":{"observed_at":"2026-08-16T10:38:27.305525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.907004Z","title":null,"venue":null,"work_id":"b2a8207a-78c5-49d3-bf28-84a9eb9ca898","year":2025},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.408830Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:ca4898a387fbfe2eb40b9f3eb4ea19f8ebd164cde9aeec903e76a38ccce3fe51","observation_id":"2f794079-b4e6-4394-8ddf-6b4cdcceb854","resolution":{"observed_at":"2026-08-16T10:38:28.911559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-16T10:38:27.435610Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.435610Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:2f5a29a5e3294f197e6827e80332e473f0f04be8b60100f52d04ed82fe6656d0","observation_id":"2d75e65c-7674-4401-aa0b-92df0c40e0f7","resolution":{"observed_at":"2026-08-16T10:38:27.435610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17231","last_updated":"2024-04-03T15:22:35Z","snapshot_observed_at":"2026-08-16T14:15:02.628360Z","submitted_at":"2024-02-27T05:50:35Z","title":"MATHSENSEI: A Tool-Augmented Large Language Model for Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17231","snapshot_observed_at":"2026-08-16T10:38:27.447288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.447288Z"},"links":{"cited_paper":"/paper/2402.17231","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:5755db3aa2c9446a2a89b79ae9641b14ac75dc52be6ba7261c771ada4b23e38e","observation_id":"32c92f81-8e5f-4c35-b37f-9c1392d60637","resolution":{"observed_at":"2026-08-16T10:38:27.447288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.534750Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.534750Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:0ba57fccc99d3c3412d47064503ebeef2d08a2babe1471353360a270c48217b0","observation_id":"4f422dc0-0654-44d6-bdbc-bda1a0d83758","resolution":{"observed_at":"2026-08-16T10:38:27.534750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T10:38:27.580437Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.580437Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:fdd05b3f9e6d1f76a65adb639d7607791cd379777c2363874cf96aee27a4a3e4","observation_id":"8749a97e-aa6b-4800-bce8-8b7d742c5859","resolution":{"observed_at":"2026-08-16T10:38:27.580437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.701912Z","title":null,"venue":null,"work_id":"61782560-9d5e-436b-867c-ab3e9b6fa5fc","year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.678437Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:2e15362d72dc82947bd2d8cce5dcf066bbe9f373b6a2a22409b673c1c075fa92","observation_id":"7b4b1caf-91ca-4e0c-bb3d-20effa818813","resolution":{"observed_at":"2026-08-16T10:38:28.842314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.705902Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.705902Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:13df7f459ed044881794b7640abce63ccf489252f529f41009ba8049f45e32d5","observation_id":"1d544743-a921-459d-993d-eb76b5a5ada0","resolution":{"observed_at":"2026-08-16T10:38:27.705902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07919","last_updated":"2023-09-12T15:08:46Z","snapshot_observed_at":"2026-08-16T16:08:23.354691Z","submitted_at":"2022-12-15T15:52:39Z","title":"ROSCOE: A Suite of Metrics for Scoring Step-by-Step Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07919","snapshot_observed_at":"2026-08-16T10:38:27.721732Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.721732Z"},"links":{"cited_paper":"/paper/2212.07919","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:22aa01cc56bf7edf1d3908ee9504e6944dea87586aba7c41651cb71a835cc480","observation_id":"da02a7ba-5c01-4ac7-af52-ff898ee082b6","resolution":{"observed_at":"2026-08-16T10:38:27.721732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17452","last_updated":"2024-02-21T12:59:22Z","snapshot_observed_at":"2026-08-15T05:04:59.720326Z","submitted_at":"2023-09-29T17:59:38Z","title":"ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17452","snapshot_observed_at":"2026-08-16T10:38:27.731733Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.731733Z"},"links":{"cited_paper":"/paper/2309.17452","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:7ef667f7576c8d881197884b704dc190b036a4c129edd2ab362bd4fa563fabb1","observation_id":"7b7701e4-daa6-4806-b3cb-94f779d066c7","resolution":{"observed_at":"2026-08-16T10:38:27.731733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05221","last_updated":"2024-08-11T22:20:19Z","snapshot_observed_at":"2026-08-16T14:02:52.207183Z","submitted_at":"2024-04-08T06:35:09Z","title":"LLM Reasoners: New Evaluation, Library, and Analysis of Step-by-Step Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05221","snapshot_observed_at":"2026-08-16T10:38:27.817668Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.817668Z"},"links":{"cited_paper":"/paper/2404.05221","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:50729747a0da26c91cbb1a98891aff083b434fb4d910717b0bf1d2e07d8a2ab3","observation_id":"83f28c52-37e4-42fd-abdb-b02d042ec52e","resolution":{"observed_at":"2026-08-16T10:38:27.817668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-16T10:38:27.856738Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.856738Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:114f543579cb0dfab1a842ec6d6816658d53ce741cad7a03351ec0a03e8e43e8","observation_id":"a1e98042-fb50-45d1-aea0-72ac99a2a6e1","resolution":{"observed_at":"2026-08-16T10:38:27.856738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05398","last_updated":"2023-03-04T04:43:49Z","snapshot_observed_at":"2026-08-16T15:50:52.123484Z","submitted_at":"2023-03-04T04:43:49Z","title":"MathPrompter: Mathematical Reasoning using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05398","snapshot_observed_at":"2026-08-16T10:38:27.861159Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.861159Z"},"links":{"cited_paper":"/paper/2303.05398","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:6114981721a8fe6ebdc8e7b3ac1eaae3ac5a5ff02acf80b9f77e07ddda9a96a2","observation_id":"7fbaa48e-c3f8-409b-b597-87b03c0d2784","resolution":{"observed_at":"2026-08-16T10:38:27.861159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11863","last_updated":"2024-04-01T08:33:11Z","snapshot_observed_at":"2026-08-16T16:56:34.956611Z","submitted_at":"2024-02-19T06:11:28Z","title":"How Interpretable are Reasoning Explanations from Prompting Large Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11863","snapshot_observed_at":"2026-08-16T10:38:27.876660Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.876660Z"},"links":{"cited_paper":"/paper/2402.11863","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:4834af339fa40d0905ef5e77d50da052e3638538cac3dd195590f313410e155f","observation_id":"8d49385a-1479-481a-a344-7af00853427a","resolution":{"observed_at":"2026-08-16T10:38:27.876660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.884720Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.884720Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:9600cba80ed3aec378fa0a9c0f1c34e9fa5f3e5385df1b0c75139dd68dbc8d29","observation_id":"ac83fd1c-703b-4bb0-af44-4e9f7c456e1b","resolution":{"observed_at":"2026-08-16T10:38:27.884720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00755","last_updated":"2024-06-02T14:16:24Z","snapshot_observed_at":"2026-08-17T04:07:36.271566Z","submitted_at":"2024-06-02T14:16:24Z","title":"Evaluating Mathematical Reasoning of Large Language Models: A Focus on Error Identification and Correction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00755","snapshot_observed_at":"2026-08-16T10:38:27.976338Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.976338Z"},"links":{"cited_paper":"/paper/2406.00755","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:976afc70c1a5c7a229e318938096baa64a092fc93e5ec9ef98f9fb5728d2aba3","observation_id":"1b945a6d-a71f-40d9-a7c0-fc80f0ffb998","resolution":{"observed_at":"2026-08-16T10:38:27.976338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-16T10:38:28.008119Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.008119Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:9c5a3a9f95b84e483d1bf307b0f5e41f9fae6146e260f822744614392f0c5134","observation_id":"fdf7c8da-a15a-4dfa-8579-c6ceee6a6bf8","resolution":{"observed_at":"2026-08-16T10:38:28.008119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.012469Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.012469Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:e3f50994b146904776793a0a47832c20fce3f82eccf41025dea3696573ae4aaa","observation_id":"a5df8063-c254-4073-ad11-dbe39036e38c","resolution":{"observed_at":"2026-08-16T10:38:28.012469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-16T10:38:28.017095Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.017095Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:c1dc3906d959dbcbfac8c5ec8da54847841437a754ebb80496e6fdb9cf8e0a09","observation_id":"db3513a4-b966-44bd-af55-159ec022d21b","resolution":{"observed_at":"2026-08-16T10:38:28.017095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13379","last_updated":"2023-09-20T22:19:30Z","snapshot_observed_at":"2026-08-16T15:58:58.468142Z","submitted_at":"2023-01-31T03:04:26Z","title":"Faithful Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13379","snapshot_observed_at":"2026-08-16T10:38:28.021493Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.021493Z"},"links":{"cited_paper":"/paper/2301.13379","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:6dceb4931692f47112062802dd47e0321c7bfe1c2b807d12dac2c54167a088e9","observation_id":"4cf74b68-30c9-40b6-8623-6fd74e7b2993","resolution":{"observed_at":"2026-08-16T10:38:28.021493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.025866Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.025866Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:274b95daf919b42759c54da034bec43f32bddf706d5e65bfa6d78a41bb2dc180","observation_id":"9ef4e6f1-ae80-4668-b1f4-36bf68506952","resolution":{"observed_at":"2026-08-16T10:38:28.025866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.069599Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.069599Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:607bc845a50586f87d2a0ee770306e23b0a06718da900e7768b340f4747d8fdc","observation_id":"8453e4c9-49b1-47bb-8ecc-f7b35f7bbb24","resolution":{"observed_at":"2026-08-16T10:38:28.069599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-16T10:38:28.135870Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.135870Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:420b8c2c4a32c61abcb10ed77fee282daea41dfddcd9e9b38649749396217e75","observation_id":"1e4e2223-d431-4ae9-9af0-a9e31ef49758","resolution":{"observed_at":"2026-08-16T10:38:28.135870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10297","last_updated":"2020-09-27T04:07:11Z","snapshot_observed_at":"2026-08-12T14:26:33.940158Z","submitted_at":"2020-09-22T03:10:49Z","title":"CodeBLEU: a Method for Automatic Evaluation of Code Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10297","snapshot_observed_at":"2026-08-16T10:38:28.140228Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.140228Z"},"links":{"cited_paper":"/paper/2009.10297","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:039d40d534f3b0dab406be7fc1f14e1f0ca4d55ec8a62cc81a6ae05681ea1cdb","observation_id":"10a79d37-2910-49f3-aff6-d11fd8c59d4c","resolution":{"observed_at":"2026-08-16T10:38:28.140228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-16T10:38:28.144373Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.144373Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:f05620a2deccadab5d128e7965347b9ea26f5da11368efa511ed56eaee6759b1","observation_id":"63a95e6a-6204-4928-98c8-5864781550c9","resolution":{"observed_at":"2026-08-16T10:38:28.144373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.148351Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.148351Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:6f4eb1ad66377c7777eca4d8765afa66e4a038193cc5c629235bc177981ee357","observation_id":"280b389d-db6e-44e7-bb5d-e48cbf25c1b3","resolution":{"observed_at":"2026-08-16T10:38:28.148351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.661124Z","title":"https://lyz-code.github.io/autoimport/ autoimport","venue":null,"work_id":"8412bdea-ab58-44bd-b677-db4e7bc6a51d","year":null},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.151866Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:6a44ac269f30c606887acf09765b4bc185d5576cebcbf7b02bfaf8043097d273","observation_id":"870b4498-931c-41cd-a6e7-abbc8839b71d","resolution":{"observed_at":"2026-08-16T10:38:28.666950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.157210Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.157210Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:9a2547dfca592ef0534b0e36e49df6c5ff851262ca883bcd1939fb6e3c3950d5","observation_id":"444747c2-aba4-48de-b594-2650b1891a9a","resolution":{"observed_at":"2026-08-16T10:38:28.157210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.161671Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.161671Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:2672224b34d760cf5a3eb3f47088d195e4e7638c85385e152f910e53641dbdd9","observation_id":"0572d174-3895-4ae9-b9ed-00e10be25196","resolution":{"observed_at":"2026-08-16T10:38:28.161671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-18T06:58:51.738907Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-16T10:38:28.165082Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.165082Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:9fd0fdd5e1b911d3fa233d58ea726a3efcfe405103717203637319d327769181","observation_id":"37de6bae-2ec7-4da3-805b-3b2633deb28f","resolution":{"observed_at":"2026-08-16T10:38:28.165082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07921","last_updated":"2023-08-15T17:58:45Z","snapshot_observed_at":"2026-08-18T00:34:56.310356Z","submitted_at":"2023-08-15T17:58:45Z","title":"Solving Challenging Math Word Problems Using GPT-4 Code Interpreter with Code-based Self-Verification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07921","snapshot_observed_at":"2026-08-16T10:38:28.255976Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.255976Z"},"links":{"cited_paper":"/paper/2308.07921","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:2a03f15d9fd75def4438baf72490bb0b4c157fc63eb7fa1fbe4641c2a9db4a21","observation_id":"386764f5-7076-40d2-9519-fa12012ec13d","resolution":{"observed_at":"2026-08-16T10:38:28.255976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05527","last_updated":"2023-10-31T13:44:36Z","snapshot_observed_at":"2026-08-17T12:44:10.727209Z","submitted_at":"2023-02-10T22:12:05Z","title":"CodeBERTScore: Evaluating Code Generation with Pretrained Models of Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05527","snapshot_observed_at":"2026-08-16T10:38:28.303524Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.303524Z"},"links":{"cited_paper":"/paper/2302.05527","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:f8e664a2b0843a76240e5d337d292e4736564d5ce8e4d8ca5d32453193ade840","observation_id":"a7e1db0b-a0d7-4091-b74b-704b71752da3","resolution":{"observed_at":"2026-08-16T10:38:28.303524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T16:57:53.492752Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2504.17665."}