{"as_of":"2026-08-11T01:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:124080f45bfd307058f4ccc9c7f087f453354dc9e86d47fbfcabd47cffeecea3","coverage":[{"denominator":167,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:11:10.254632Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00309/citation-record","integrity":"/paper/2506.00309/integrity","json":"/paper/2506.00309/citation-record.json","paper":"/paper/2506.00309"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:00.851613Z","title":"Liljedahl and M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:00.851613Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ada2dc0ac60e64b182548a89282411920ba09bfdc7b60dc3a3123f371338c9f7","observation_id":"b126cd2a-fbb3-4fda-b06f-9013bc4a6509","resolution":{"observed_at":"2026-08-07T12:11:00.851613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:00.964008Z","title":"Students’ difficulties in mathemat- ics problem-solving: What do they say?","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:00.964008Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:081a1b1679282838d71125f47b84aa2f337cdc811f58e13afbe7864e9db823d4","observation_id":"8355b285-aa54-41ff-bde8-4feb655a3f0e","resolution":{"observed_at":"2026-08-07T12:11:00.964008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.073139Z","title":"Abstraction in mathematics and mathe- matics learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.073139Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9f72e9c81e448691c15ad29bbe72aa8eb8a5c66088a784e27eb0ebd379911a86","observation_id":"a7a106cd-a495-447c-8db9-ec08fb693083","resolution":{"observed_at":"2026-08-07T12:11:01.073139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.205303Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.205303Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b9acbd2cf6cf83fbe483dd71be4c3f17d446e70175154b336f3f39bafe180926","observation_id":"eb456850-b714-4bd6-aea5-7bb16a82f320","resolution":{"observed_at":"2026-08-07T12:11:01.205303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.271200Z","title":"Mathematics: con- ceptions, learning and teaching,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.271200Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:2945053c64bc35b37ecd0823247a2c2c3ea93de7ed746ef4d3099ccc656b5efc","observation_id":"476b006a-e7ed-47f3-ac23-5a4879f61bc9","resolution":{"observed_at":"2026-08-07T12:11:01.271200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.392215Z","title":"The nature, e ffects, and relief of mathematics anxiety,","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.392215Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e50f935e1315d5faadfe534823cd9976dd0e78c14b3c864c76ea98ad4cd6e7e4","observation_id":"0027aab8-e1c9-4dcd-b43c-3d33e7212d0b","resolution":{"observed_at":"2026-08-07T12:11:01.392215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.508538Z","title":"Development of ab- stract mathematical reasoning: the case of algebra,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.508538Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:29557d65fe9e8a675a92027205d0687111c075c8bc7ec31af2af808f7bf99e5e","observation_id":"f73b643a-24fa-4489-a760-6dd3e69393c8","resolution":{"observed_at":"2026-08-07T12:11:01.508538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.601971Z","title":"The logical thinking ability: Math- ematical disposition and self-regulated learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.601971Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:2b52caebcd6adddb05d562cbccb4bf42ab917a5d5ff02f66a750c7acf216c0ed","observation_id":"d418b757-5124-445b-bd58-32205dd3c0a3","resolution":{"observed_at":"2026-08-07T12:11:01.601971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.749051Z","title":"Developing critical thinking skills of students in mathematics learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.749051Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9c1a47b7c40acff6fe6cdffdb606f0e59960544d49cd96df882a39a1ad5d0b7d","observation_id":"72f54e55-77f8-4fb1-9acd-2ee3928ead27","resolution":{"observed_at":"2026-08-07T12:11:01.749051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.849489Z","title":"Critical thinking: Essence for teaching mathematics and mathematics problem solving skills,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.849489Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:48e1a239a4d0b2c19eaff7d7bb26b54dc9a50b614cbbc30d3e5e27070edd59ba","observation_id":"baf5d3d6-edd2-4b35-a1c9-d3b7decf2242","resolution":{"observed_at":"2026-08-07T12:11:01.849489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.909174Z","title":"Artificial intelligence in mathemat- ics education: A systematic literature review,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.909174Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e44a711c930a6c036d09502200bc68602d3330dd1652b7bbf7bf8cf09da0922b","observation_id":"5356daae-2487-421c-a372-234056285456","resolution":{"observed_at":"2026-08-07T12:11:01.909174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.004556Z","title":"The importance of educational technology in teaching,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.004556Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:7eedf6db603e5975bf5fe8423d260ef90ab498733119e776699061971fde581d","observation_id":"2b4f91e6-efca-4468-a963-dc977e05a7e4","resolution":{"observed_at":"2026-08-07T12:11:02.004556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.121046Z","title":"Benefits and limitations of the artificial with respect to the traditional learning of mathematics,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.121046Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:8099cbacab2868f98c273515dd4113d152653321452778bfb1bdefbf53771ed8","observation_id":"3a31535c-51c4-4c82-a501-8b2782b86147","resolution":{"observed_at":"2026-08-07T12:11:02.121046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.220955Z","title":"The use of interactive learning technologies in math classes,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.220955Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:02d7be724a9bb9f96bf9b7f28e30da743f05a0282b7a50eab93422b1c9103e8f","observation_id":"8b125688-d6e3-4666-87d5-400f89c2fa89","resolution":{"observed_at":"2026-08-07T12:11:02.220955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.300441Z","title":"Going the distance with on- line education,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.300441Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:3743e3f902cc084a671a09db35aa3d57527a43594928cf30bd321a138f0ee542","observation_id":"c1e65fd8-e24f-4586-9b25-053995444cfb","resolution":{"observed_at":"2026-08-07T12:11:02.300441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.422984Z","title":"Natural language processing in the era of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.422984Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a5565cf919022f9617090e8253db2992bf71ad062dcc36c356e237bfc3227a20","observation_id":"cfd6c230-e9e3-4fd4-b9d8-10e63d29e16e","resolution":{"observed_at":"2026-08-07T12:11:02.422984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.510129Z","title":"An introduction to key technology in artifi- cial intelligence and big data driven e-learning and e-education,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.510129Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:09581f61132bb634caa9bbe43c649214a2cffdae3ea655881db2f2a29cc9b82c","observation_id":"74b81c41-a281-4874-a06a-9c20d8d59247","resolution":{"observed_at":"2026-08-07T12:11:02.510129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.611345Z","title":"Learning mathematics with large language models: A comparative study with computer algebra systems and other tools,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.611345Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a1d28f216fbf7e45bbc049beef17f46034a6d7de44a6346e3755e8d3ed1940c6","observation_id":"6136ad48-370b-4084-ac5d-ff93b68d82c2","resolution":{"observed_at":"2026-08-07T12:11:02.611345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.735379Z","title":"Johnsen, Large language models (LLMs)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.735379Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:3cd619e1ff95d11a7a24c175aaf9823ed240d95567785554e890012bb20c6d4b","observation_id":"1835dec6-fc06-4e6b-b90b-2263b2075583","resolution":{"observed_at":"2026-08-07T12:11:02.735379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.841784Z","title":"Talking about large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.841784Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b206e48531b47f42c5031f7ab30116d4db25bc0a9e0f60c36fc3ee0c75d7f113","observation_id":"cbd35221-ecf3-4956-a89f-45298c8ae694","resolution":{"observed_at":"2026-08-07T12:11:02.841784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.926949Z","title":"A survey on large language mod- els: Applications, challenges, limitations, and practical usage,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.926949Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:30684b84f7a7dbce4955166d69fc65558430ef2d2b882b80ff69a44e5361d807","observation_id":"08562342-160e-4ef3-b401-acc1c91add5c","resolution":{"observed_at":"2026-08-07T12:11:02.926949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T12:11:03.019514Z","title":"A survey of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.019514Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:df348605cb29333a628a75367b4439767453a9ad80e5fddacf9f712faeb6e3bb","observation_id":"c27f8372-8ac1-4df7-8b9d-0982952807a7","resolution":{"observed_at":"2026-08-07T12:11:03.019514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10169","last_updated":"2023-07-19T17:55:13Z","snapshot_observed_at":"2026-08-10T14:34:24.189939Z","submitted_at":"2023-07-19T17:55:13Z","title":"Challenges and Applications of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10169","snapshot_observed_at":"2026-08-07T12:11:03.124472Z","title":"Challenges and applications of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.124472Z"},"links":{"cited_paper":"/paper/2307.10169","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:52ae048b9559b91135049e1b718a3154af403f3ee67e6e549e5a5eb2c7035572","observation_id":"caa62ccc-1abb-4958-bcc5-1c7c78906114","resolution":{"observed_at":"2026-08-07T12:11:03.124472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.227877Z","title":"The evolution of human-computer interaction: From com- mand lines to conversational interfaces powered by large language mod- els,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.227877Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:1eb5021749149e0f83446b076390ec63b099ced631d7de53f1e77f99d53aa2f0","observation_id":"ae56251e-4ab6-4df1-8ff0-091ee9645c41","resolution":{"observed_at":"2026-08-07T12:11:03.227877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.303568Z","title":"Enhancing human-computer in- teraction through ai: A study on chatgpt in educational environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.303568Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:d8c403208ebf41aec2807c20665ec55fe24a21557ebbb71a8ecd1adfce925736","observation_id":"ae609cdc-789a-4d7f-83ba-6d04cfc3e662","resolution":{"observed_at":"2026-08-07T12:11:03.303568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.407113Z","title":"Large language models: a com- prehensive survey of its applications, challenges, limitations, and future prospects,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.407113Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:962c065c3f836c1f6c28785f5f826754aed0a915ce17dbfc2e0a41eea573b59a","observation_id":"4fafd64c-ae9b-4fec-adb1-3f4fd71a15b9","resolution":{"observed_at":"2026-08-07T12:11:03.407113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13410","last_updated":"2024-11-20T15:52:03Z","snapshot_observed_at":"2026-07-06T19:53:12.584883Z","submitted_at":"2024-11-20T15:52:03Z","title":"A Survey On Enhancing Reinforcement Learning in Complex Environments: Insights from Human and LLM Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13410","snapshot_observed_at":"2026-08-07T12:11:03.514978Z","title":"A survey on enhancing reinforce- ment learning in complex environments: Insights from human and llm feedback,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.514978Z"},"links":{"cited_paper":"/paper/2411.13410","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:2f3a6eb0fc46f94b4266a9593aa14a44b63f51edb82a7f2dbd09fe31727fae76","observation_id":"2af1b1a6-5461-4764-9987-518e640f6b4c","resolution":{"observed_at":"2026-08-07T12:11:03.514978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.616330Z","title":"A multifaceted vision of the human-ai collaboration: a comprehensive review,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.616330Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:25096b5af98aa2726f37e5658340c10150a40a39975625e4e1fdcc7cbab1f292","observation_id":"dd3caf2d-706a-4b30-9097-e14c138d2660","resolution":{"observed_at":"2026-08-07T12:11:03.616330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.706929Z","title":"Practical and ethical challenges of large lan- guage models in education: A systematic scoping review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.706929Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:97e143116f78bca9ff33d1c0e8ff9115c86f5d5e284099498bbbeadcdbcbbaa2","observation_id":"c8b03f50-99f3-4f96-a9d8-c5c2fc5b8c34","resolution":{"observed_at":"2026-08-07T12:11:03.706929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.819765Z","title":"Challenges and future directions of big data and artificial intelligence in education,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.819765Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e113e241092e4944727555070ef27b10c0b669cfd253f3fae4f575258246dccc","observation_id":"37bb07f1-3cbb-4c5f-8bff-0f4ba58da239","resolution":{"observed_at":"2026-08-07T12:11:03.819765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.933432Z","title":"Exploring the possibility and implementation of ai- supported online math coaching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.933432Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:95d13b0b25ead5dd11e76a7649fb4657579f5cfd7b95e44a82e55d65deb8a541","observation_id":"9aab7e55-00a7-4628-b92c-f367da63a234","resolution":{"observed_at":"2026-08-07T12:11:03.933432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.064556Z","title":"Artificial intelligence in mathemat- ics education: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.064556Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:00e00c43f33ee7b2bcdda8824f00b96e3eb4442a6f07955a803d8cf0dc8dc06c","observation_id":"59e23953-e45e-420f-bfed-f5006c0ae27d","resolution":{"observed_at":"2026-08-07T12:11:04.064556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.184768Z","title":"Information analysis of advanced mathematics education- adaptive algorithm based on big data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.184768Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ddfe6443255f2822b9a75d85a2e9b771f81a2d839d9feeaf611916c171d1ef3e","observation_id":"58f15af5-3b03-46b3-ba1d-d92448182945","resolution":{"observed_at":"2026-08-07T12:11:04.184768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.275157Z","title":"Deep learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.275157Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:fe9954ee7761e11b2915da7aaa04fef61e878d55677400330c91c5772793502e","observation_id":"44e3992f-ddd7-4f73-a1cf-372811cafc6f","resolution":{"observed_at":"2026-08-07T12:11:04.275157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.448313Z","title":"Development and application of artificial neu- ral network,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.448313Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:61fa2cf81d11bcdc4fcf73e66a627eb3ce5f24d2ad4d91fa56db5e7ad9f39727","observation_id":"c2bf6fd4-a8dc-4e3b-8be2-ac8406590155","resolution":{"observed_at":"2026-08-07T12:11:04.448313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.554772Z","title":"Large language models (llms): survey, technical frameworks, and future challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.554772Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:d137503777ce2cc9d992c06bc47115d0e91e2536cb1f3ee1ab28d9d1edcc051d","observation_id":"4b4af792-23f8-4385-bec1-f176ca4608d1","resolution":{"observed_at":"2026-08-07T12:11:04.554772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.629357Z","title":"When large language models meet personal- ization: Perspectives of challenges and opportunities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.629357Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:c8dee8706fa4eec7e426931be1cd9b2c32717370f7ada24e80ab33ba698d28a1","observation_id":"b2e6f0ab-bde4-4160-9b32-623db9971058","resolution":{"observed_at":"2026-08-07T12:11:04.629357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-07-29T20:40:25.374189Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-07T12:11:04.753361Z","title":"A survey on large lan- guage models for code generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.753361Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:731dae1194a57ec2c8b18a2982b53162057a9e6f5c56fd5d5d49c8decf235fbe","observation_id":"4352d3f5-fbd5-4089-9060-5a911084ff2d","resolution":{"observed_at":"2026-08-07T12:11:04.753361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18041","last_updated":"2024-02-28T04:35:51Z","snapshot_observed_at":"2026-08-10T11:54:17.093865Z","submitted_at":"2024-02-28T04:35:51Z","title":"Datasets for Large Language Models: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18041","snapshot_observed_at":"2026-08-07T12:11:04.838038Z","title":"Datasets for large language models: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.838038Z"},"links":{"cited_paper":"/paper/2402.18041","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e6162265dec1a5b0ea16ec1cba364db02b4d35e5f0e76633505d828cf4f75947","observation_id":"d0fe05dd-d75b-4337-905d-ca5461442db7","resolution":{"observed_at":"2026-08-07T12:11:04.838038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.931898Z","title":"Harnessing large language mod- els’ zero-shot and few-shot learning capabilities for regulatory research,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.931898Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:06fa959dbb480ce46f1040a3ea2cac53cce69cf5190e83b39ee48351b5b137ce","observation_id":"1d131f1f-497f-418c-a913-6be5f6a52b18","resolution":{"observed_at":"2026-08-07T12:11:04.931898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.029752Z","title":"Alto, Modern Generative AI with ChatGPT and OpenAI Models: Leverage the capabilities of OpenAI’s LLM for productivity and inno- vation with GPT3 and GPT4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.029752Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:c90f9505cc390b09c744262c75011dc6dd6e1ee39df2cf0d143d5c85f6505500","observation_id":"b7857093-262e-4a0b-9f54-230f61b8af7f","resolution":{"observed_at":"2026-08-07T12:11:05.029752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.126570Z","title":"Google gemini as a next generation ai educational tool: a review of emerging educational technology,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.126570Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:334552bc9975a095ccfcd2ff395eb88ac32c8f4842fd616b8e9d6bb65649fe34","observation_id":"b69087e0-5f88-4787-a5e6-448fc5662e1a","resolution":{"observed_at":"2026-08-07T12:11:05.126570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.204977Z","title":"A survey of deepseek models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.204977Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:360d0fca21843550c2fd2f160e6768f95a3894332697925c6e5dbeccfbd186e0","observation_id":"c2e3d4f3-0c0e-49e4-82a2-a01a357d685f","resolution":{"observed_at":"2026-08-07T12:11:05.204977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04783","last_updated":"2025-02-25T19:55:35Z","snapshot_observed_at":"2026-08-07T17:49:05.909948Z","submitted_at":"2025-02-25T19:55:35Z","title":"Comparative Analysis Based on DeepSeek, ChatGPT, and Google Gemini: Features, Techniques, Performance, Future Prospects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04783","snapshot_observed_at":"2026-08-07T12:11:05.309517Z","title":"Comparative analysis based on deepseek, chatgpt, and google gem- ini: Features, techniques, performance, future prospects,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.309517Z"},"links":{"cited_paper":"/paper/2503.04783","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:33a031c80a34d29a22533e2d3629ab3795ff965fdfdf8bf4c7d69099929aea1c","observation_id":"012911c5-e066-487b-912c-b909f6b4843a","resolution":{"observed_at":"2026-08-07T12:11:05.309517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.439080Z","title":"Bias and fairness in large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.439080Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:8ea9423b0ecdfbe96d3940efb2aba9651e71c43aa3eb51145d2cbc1881b5d093","observation_id":"3990a575-fd8d-488f-bc84-f2c124418b41","resolution":{"observed_at":"2026-08-07T12:11:05.439080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.528866Z","title":"Large language models (llm) in compu- tational social science: prospects, current state, and challenges,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.528866Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:2d1dca35b4c47a35b4449070cbe32d9d03e4e1f5311c87b15ad129d69107de7e","observation_id":"f23486ab-3635-4929-b30f-6057e900c13f","resolution":{"observed_at":"2026-08-07T12:11:05.528866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.611256Z","title":"Foundation and large language models: fundamentals, challenges, op- portunities, and social impacts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.611256Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e551d3ffbb598409df8f2b028b5c08208d38d0653030846f7af802b57fed21ba","observation_id":"9fa01db6-8877-4789-aed3-4f2cc81ce452","resolution":{"observed_at":"2026-08-07T12:11:05.611256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.736888Z","title":"Llm challenges and solutions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.736888Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ebceba1f2fb846273240a8075d8dd081c3e7e220b951548c7b8da0325f5570db","observation_id":"e2176361-e4c1-46bb-8a54-fecb6e9666bf","resolution":{"observed_at":"2026-08-07T12:11:05.736888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.838896Z","title":"A step-by-step solution methodology for mathematical expressions,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.838896Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b2a0721d91e648033e2595c4955c45ea91bc9c5f40248d2a6b41d6f0b4ba1812","observation_id":"ee991bde-b2c9-47c7-a839-2e2611e92eac","resolution":{"observed_at":"2026-08-07T12:11:05.838896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.917752Z","title":"Solving mathematical problems using large language models: A survey,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.917752Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:534dd17d75140d0aa7425cc13486d44320dc7a2e7530fc8091c209734b8279fb","observation_id":"45af079e-53e1-4438-aff2-a36e7c0570c1","resolution":{"observed_at":"2026-08-07T12:11:05.917752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05713","last_updated":"2025-02-20T15:16:06Z","snapshot_observed_at":"2026-07-06T16:04:58.235073Z","submitted_at":"2023-08-10T17:22:28Z","title":"Testing GPT-4 with Wolfram Alpha and Code Interpreter plug-ins on math and science problems","version":4},"cited_work":{"arxiv_id":"2308.05713","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.05713","snapshot_observed_at":"2026-08-07T12:11:19.048599Z","title":"Testing GPT-4 with Wolfram Alpha and Code Interpreter plug-ins on math and science problems","venue":"cs.AI","work_id":"950cd52d-7d67-4e9d-924a-b50c5e3335b4","year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.046481Z"},"links":{"cited_paper":"/paper/2308.05713","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:6d7fb3f5726ec83917be89a5414d48931db745996053f9747b72ca22b1f719a2","observation_id":"fb72275c-326f-400e-91e2-b7fd7e4764d5","resolution":{"observed_at":"2026-08-07T12:11:19.122358Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.170880Z","title":"Assessing the performance of ai-generated code: A case study on github copilot,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.170880Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:25814867e557cc1d525feaeb32f862668582a633e7e77c74bbfc0246ca36ed60","observation_id":"7df8c725-2ba5-407e-9ecf-879bd0badedb","resolution":{"observed_at":"2026-08-07T12:11:06.170880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16673","last_updated":"2023-10-25T14:38:40Z","snapshot_observed_at":"2026-08-10T09:09:52.787336Z","submitted_at":"2023-10-25T14:38:40Z","title":"Exploring Large Language Models for Code Explanation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16673","snapshot_observed_at":"2026-08-07T12:11:06.303541Z","title":"Exploring large language models for code explanation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.303541Z"},"links":{"cited_paper":"/paper/2310.16673","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a8b0ea477fac0dc60c7c0ba9df174e826d0fb1cec3b975200209ac5c831d30a5","observation_id":"ed7b28c0-6349-4941-bb6e-e8fc0788fae2","resolution":{"observed_at":"2026-08-07T12:11:06.303541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.395561Z","title":"Automatic programming: Large language models and beyond,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.395561Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:4b52ac0e861f9d660d79dc4a285d3a89622ac9bb338a4a4d9d18eed2e0d4b740","observation_id":"a98a37f7-2523-40ff-bac3-7ccbd941818a","resolution":{"observed_at":"2026-08-07T12:11:06.395561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.509590Z","title":"Intelligent computing: the latest advances, challenges, and future,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.509590Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a64b19f1d82d137291078493bba0b8cc38fa7cd56632b41b9cf4103cd10122f5","observation_id":"cfbc08c1-5198-46d5-a96f-8f1d4f0dbea6","resolution":{"observed_at":"2026-08-07T12:11:06.509590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.589247Z","title":"Bridging machine learning and logical reasoning by abductive learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.589247Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ffe8a6daaa9d6ebe5baeba759a9334a6f5850b4774d8a50accbe9ea7cf1fa482","observation_id":"53128e99-3706-43cf-8a71-54d14cac1662","resolution":{"observed_at":"2026-08-07T12:11:06.589247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12209","last_updated":"2024-05-20T17:52:29Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:52:29Z","title":"MathBench: Evaluating the Theory and Application Proficiency of LLMs with a Hierarchical Mathematics Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12209","snapshot_observed_at":"2026-08-07T12:11:06.681146Z","title":"Mathbench: Evaluating the theory and application proficiency of llms with a hierarchical mathematics benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.681146Z"},"links":{"cited_paper":"/paper/2405.12209","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:591fbf7819295a2093af0d6aebe7b0511da66114cc2ed603a122d809e66bcaf0","observation_id":"74b9d6e3-901c-4cb0-827e-7c7c600334f7","resolution":{"observed_at":"2026-08-07T12:11:06.681146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.774134Z","title":"Metacog- nitive capabilities of llms: An exploration in mathematical problem solv- ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.774134Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e531d26ecf2f477594f422d5ef6fbbdebdec985f1e7bcc8f75c38fb4cbc65e5b","observation_id":"bf914875-85f5-4cec-80e6-5bdb60b86345","resolution":{"observed_at":"2026-08-07T12:11:06.774134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","snapshot_observed_at":"2026-08-04T15:30:23.647107Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18486","snapshot_observed_at":"2026-08-07T12:11:06.862023Z","title":"A systematic study and comprehensive evaluation of chat- gpt on benchmark datasets,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.862023Z"},"links":{"cited_paper":"/paper/2305.18486","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:f392f21820d3eeda672b98ee13dc07ced07466a84c26f8fc56fa23025e0ca283","observation_id":"c2b25631-689f-4039-a697-f7538705028e","resolution":{"observed_at":"2026-08-07T12:11:06.862023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.927980Z","title":"A survey on evaluation of large language mod- els,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.927980Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9120083448cc5987d775cd3415563464ac32608d18f8c9021bd613f991156a3b","observation_id":"33f473ca-fd4f-497b-88a3-c35520879755","resolution":{"observed_at":"2026-08-07T12:11:06.927980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.028464Z","title":"Surampudi, Big Data Meets LLMs: A New Era of Incident Monitor- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.028464Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:1df04b99f0be9fc47c55d1152183e98f1e8ea0fadf21082e9f22e4137a522675","observation_id":"cd97d080-e80a-479c-9490-2982e88b4b04","resolution":{"observed_at":"2026-08-07T12:11:07.028464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.149322Z","title":"E ffect of chat gpt on the digitized learning process of university students,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.149322Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:91a17b58e361196458a1d04bf772fd5faf7bf5807048d7bcdfcd7a93bc1481ae","observation_id":"7f88e224-53e0-4d3b-9215-3a8af6ef2c3a","resolution":{"observed_at":"2026-08-07T12:11:07.149322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.250637Z","title":"The e ffects of over-reliance on ai dialogue systems on students’ cognitive abilities: a systematic review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.250637Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9be9268a982e9a95dafc963210a339ad291d4682603a8ea6de405bd44624cd91","observation_id":"f84551d4-ecfb-4656-9020-79b536764ebb","resolution":{"observed_at":"2026-08-07T12:11:07.250637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.329186Z","title":"Chatgpt: The end of online exam in- tegrity?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.329186Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:fef342f36182a6b83318baab6e2bb4c2acfc58c13bb5222591851289b24e2a2a","observation_id":"d68c9621-1e78-4617-be13-df4c8da886be","resolution":{"observed_at":"2026-08-07T12:11:07.329186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.412204Z","title":"Ethical principles for artificial intelligence in education,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.412204Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:186d479eb5bcfa47a5289c15221d4aaada1830b9651885ef96a3eee71085424b","observation_id":"33ff6b33-a55c-4a90-a9f9-fe22356fe051","resolution":{"observed_at":"2026-08-07T12:11:07.412204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16075","last_updated":"2024-12-20T17:19:24Z","snapshot_observed_at":"2026-08-10T16:31:30.588988Z","submitted_at":"2024-12-20T17:19:24Z","title":"Formal Mathematical Reasoning: A New Frontier in AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16075","snapshot_observed_at":"2026-08-07T12:11:07.530445Z","title":"Formal mathematical reasoning: A new frontier in ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.530445Z"},"links":{"cited_paper":"/paper/2412.16075","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:920d760b27abb06c8741567ae3c122e02a7ad2606db36bd89aaa530c12b03f98","observation_id":"10a97baa-5882-4fe7-adba-ef79bab38783","resolution":{"observed_at":"2026-08-07T12:11:07.530445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.614786Z","title":"Generative ai and future education: a review, theoretical validation, and authors’ perspective on challenges and solutions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.614786Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b8e49236cf9aa86cdbd3cb3ca763059c707e7257a8aa83b98c33435981b01252","observation_id":"e951661c-e566-4beb-b14b-8a0c537bafcb","resolution":{"observed_at":"2026-08-07T12:11:07.614786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02029","last_updated":"2025-05-19T03:42:27Z","snapshot_observed_at":"2026-07-06T16:14:22.182217Z","submitted_at":"2023-09-05T08:15:00Z","title":"The Impact of Artificial Intelligence on the Evolution of Digital Education: A Comparative Study of OpenAI Text Generation Tools including ChatGPT, Bing Chat, Bard, and Ernie","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02029","snapshot_observed_at":"2026-08-07T12:11:07.684271Z","title":"The impact of artificial intelligence on the evolution of digital education: A compara- tive study of openai text generation tools including chatgpt, bing chat, bard, and ernie,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.684271Z"},"links":{"cited_paper":"/paper/2309.02029","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9c4fbafd2d0b4c86979ccb002141ce87cae3364d7ee539f9189503a5d7354584","observation_id":"b3dc2917-2999-4746-b55a-968045811af5","resolution":{"observed_at":"2026-08-07T12:11:07.684271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.756693Z","title":"Machine learning and deep learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.756693Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:bb2f6c4093d28c878a584cbdbc7976a5f15dff14d0002ad2d8803636eb146adb","observation_id":"d5143984-5a8c-4b22-a447-02cc5aff939b","resolution":{"observed_at":"2026-08-07T12:11:07.756693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.849842Z","title":"Deep learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.849842Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:c75f720bbd05e39a249d742d4b3c82f751e0a3629597cece88c4fc2747734d4e","observation_id":"94238204-d254-4503-97fc-64632728c0df","resolution":{"observed_at":"2026-08-07T12:11:07.849842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.907581Z","title":"Scaling laws of data- driven machine learning models: A survey and taxonomy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.907581Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a76edf4525c801d5901058a956ca2ddb5abcb0930a875917221efd366c4f8e69","observation_id":"d48275ff-36df-4918-a769-289e5ccb8da6","resolution":{"observed_at":"2026-08-07T12:11:07.907581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.966899Z","title":"Deep learning & its applications,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.966899Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:6e77a1fd8a00af449139b47fcf5aeca22eb32dde16e799293157bb4450fae6b5","observation_id":"df2893db-3024-4993-a7a3-24f17d12ddda","resolution":{"observed_at":"2026-08-07T12:11:07.966899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.034045Z","title":"Deep learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.034045Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:789a7a7c27d704f9727566b1cec088ef59f4c3fa2c40cadde789505a5f362909","observation_id":"d4ba57f3-414b-45d7-aa67-3f1b78852a1f","resolution":{"observed_at":"2026-08-07T12:11:08.034045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.104136Z","title":"Mehrotra, Basics of artificial intelligence & machine learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.104136Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:bb8648f347604e30941679cfdf2e7c79e0b7ddbbd58468c77cbead35869ce9e2","observation_id":"0498e75f-08ff-461b-92d0-60b4cc11a5e3","resolution":{"observed_at":"2026-08-07T12:11:08.104136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.201998Z","title":"A study of challenges and limitations to ap- plying machine learning to highly unstructured data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.201998Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:0ed4efa2c78c881fed0788a374465069ee3760aae23713a5c7b4f528768cdf14","observation_id":"c9be37da-968e-4398-b136-150d2f39f50d","resolution":{"observed_at":"2026-08-07T12:11:08.201998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.257518Z","title":"Supervised learning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.257518Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b6b0ca2ccd7af572cc0f2e58cef14a6213887a4a54bfed7ad5e83cbc287801f4","observation_id":"9b5cc850-5ebb-4ab5-946d-34114026904d","resolution":{"observed_at":"2026-08-07T12:11:08.257518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.327675Z","title":"Self- attention and transformers: Driving the evolution of large language mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.327675Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:565dd3137e9461ea7ec242204d7499d6751ddf9805473dc654f04df172146468","observation_id":"1b5c9c74-44db-46f5-bd0b-0c3e6ae0dc8b","resolution":{"observed_at":"2026-08-07T12:11:08.327675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.393988Z","title":"A review on large language models: Architectures, applications, taxonomies, open issues and challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.393988Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:fbd386ce5214ccf7fcbe6d1f2ef366c719b805189f6cb133407897972b317005","observation_id":"75359080-5c58-4fa0-b19c-80c16893de67","resolution":{"observed_at":"2026-08-07T12:11:08.393988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.498428Z","title":"Large language models, fine tuning, code generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.498428Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:5668217ba79d0cf00e7c5e858753e02db6e83878a9e39d942f40394854bc5c00","observation_id":"03a91b66-46ab-40d4-bfe9-99c408b0ce13","resolution":{"observed_at":"2026-08-07T12:11:08.498428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.566597Z","title":"Machine learning and deep learning for big data analytics: A review of methods and applications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.566597Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:966e6268fd280be9831ada39ecf197298ed3b771f6a362c73baade9ee3c33c68","observation_id":"4f8dde0f-ae85-4fb4-8011-058c2aa96374","resolution":{"observed_at":"2026-08-07T12:11:08.566597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.617970Z","title":"Chatgpt and open-ai models: A preliminary review,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.617970Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b52bfe9f52199a81e0f9f168ef177407b4edac51f5597698a497defb53af60a0","observation_id":"edfd2758-a0d0-4373-b05c-89b60cfa1294","resolution":{"observed_at":"2026-08-07T12:11:08.617970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.676334Z","title":"Gpt (generative pre-trained transformer)–a comprehensive re- view on enabling technologies, potential applications, emerging chal- lenges, and future directions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.676334Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:fad682abe8e4c420d2f537b028cb02cef69dcdec27ce91044cc82e794cca889c","observation_id":"fed8dbd0-2a98-498a-857b-5761f7812927","resolution":{"observed_at":"2026-08-07T12:11:08.676334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.733316Z","title":"Research on text classification model based on self-attention mechanism and multi-neural network","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.733316Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:6b6e3104a6f433dc03d8bf23a6252c6ccb2679b0dfe636c4f76a50c9e545e65c","observation_id":"aea37d90-4e23-4bf7-aab0-22c12d9519a7","resolution":{"observed_at":"2026-08-07T12:11:08.733316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.822768Z","title":"Chatgpt–technical research model, capability analysis, and application prospects,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.822768Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:fe35b3f73d730c9c71a73afa60c34868ce2dbc255541d8f872f960ec68a91ee9","observation_id":"697c5d3a-f515-49fb-9b41-7bee1d751912","resolution":{"observed_at":"2026-08-07T12:11:08.822768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.901088Z","title":"A sur- vey of reinforcement learning from human feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.901088Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:2158b853878a20aa7a3610002a3d5686bf368d8eb737f7e03c1c2870721560ab","observation_id":"2a5fe638-4672-45d3-b6c5-93ebaecab853","resolution":{"observed_at":"2026-08-07T12:11:08.901088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.971340Z","title":"Summary of chatgpt-related research and perspective towards the future of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.971340Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:3ef3177fc11d7a1a71ec6828e6d6428bf732e70d9d981e80360b991e50deee6a","observation_id":"ab55b070-2f43-4cd9-9836-b9f5f14f023c","resolution":{"observed_at":"2026-08-07T12:11:08.971340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12057","last_updated":"2023-08-26T19:29:03Z","snapshot_observed_at":"2026-08-08T16:46:26.275852Z","submitted_at":"2023-07-05T17:05:32Z","title":"External Reasoning: Towards Multi-Large-Language-Models Interchangeable Assistance with Human Feedback","version":2},"cited_work":{"arxiv_id":"2307.12057","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.12057","snapshot_observed_at":"2026-08-07T12:11:18.648640Z","title":"External Reasoning: Towards Multi-Large-Language-Models Interchangeable Assistance with Human Feedback","venue":"cs.CL","work_id":"ec962fc2-2e2e-4f17-9606-9b27a1ac50f5","year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.034004Z"},"links":{"cited_paper":"/paper/2307.12057","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:1c376c64f09cc87e3605889b13145b675b4ecfa2dd980ce9e17cbdcc4f5e1179","observation_id":"a1bd029c-0381-4646-9d80-b1144f68e6f0","resolution":{"observed_at":"2026-08-07T12:11:18.745298Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.164900Z","title":"Use of language by generative ai tools in mathematical problem solving: The case of chatgpt,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.164900Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:3046ae32b4dee376d0f91ade8f3d181f291261e02ace54794cbdd749ac4bbf7d","observation_id":"7cdd153a-f3c0-4418-80ba-91966e5d3d4f","resolution":{"observed_at":"2026-08-07T12:11:09.164900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06331","last_updated":"2023-10-31T08:21:20Z","snapshot_observed_at":"2026-08-08T01:21:47.968828Z","submitted_at":"2023-06-10T02:01:02Z","title":"Investigating the Effectiveness of ChatGPT in Mathematical Reasoning and Problem Solving: Evidence from the Vietnamese National High School Graduation Examination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06331","snapshot_observed_at":"2026-08-07T12:11:09.261782Z","title":"Investigating the e ffectiveness of chatgpt in mathematical reasoning and problem solving: Evidence from the viet- namese national high school graduation examination,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.261782Z"},"links":{"cited_paper":"/paper/2306.06331","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:8e7be75eaf659c5b8c476d4c69cbe7a2e80260ce7d791b295f34e6495856a12a","observation_id":"c8f1fda9-08b2-4a2e-9adb-4c7b5f61817c","resolution":{"observed_at":"2026-08-07T12:11:09.261782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.359604Z","title":"Chatgpt challenges blended learning methodologies in engineering education: A case study in mathematics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.359604Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:4f45b587e189bbc290b8ea05039f37bf2275e661a2b22c75c7e8bca92ea0172e","observation_id":"7298970c-09c7-4245-95e3-d23a0ac2c79d","resolution":{"observed_at":"2026-08-07T12:11:09.359604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.482133Z","title":"Mathematical capabilities of chatgpt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.482133Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:d2e304c7f2bda9cd6143bf14555f8a2815a0914c03a49e2ce8c9c6f630a236e8","observation_id":"1d3785e1-dde0-4be5-ac83-5b75ba519f00","resolution":{"observed_at":"2026-08-07T12:11:09.482133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.546459Z","title":"Deepseek and china’s ai renaissance: The rise of the four dragons and six tigers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.546459Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e5d6959135129825f0850b35360d4b409b9e932a431f9272331681138202dae3","observation_id":"67433008-2cf1-44ba-a04f-4711df9cb7ad","resolution":{"observed_at":"2026-08-07T12:11:09.546459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.648870Z","title":"Deepseek large-scale model: technical analysis and develop- ment prospect,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.648870Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9daa9469a3dd403f064d3d59dbe8edb4e79e0ac30768e1a569e2a0b09ce08ad9","observation_id":"18f0856f-b509-44a9-a600-6914d7f66824","resolution":{"observed_at":"2026-08-07T12:11:09.648870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.719666Z","title":"Deepseek models: A comprehensive survey of methods and applications","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.719666Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:219f6e8342f0ca3fbb8b3645766ad4a2a6c5ae0f2d3d261dd93ce1eac97c268b","observation_id":"76dec044-029b-4a62-9844-88bf07db8be8","resolution":{"observed_at":"2026-08-07T12:11:09.719666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.806021Z","title":"A survey on complex reasoning of large language models through the lens of self-evolution,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.806021Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e1d7be74bdae624e8120d324244b538913f508c84031ce06102768cc3cb2bda0","observation_id":"b9b50c11-9897-47a6-be1d-c90933844780","resolution":{"observed_at":"2026-08-07T12:11:09.806021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16352","last_updated":"2025-01-18T20:17:31Z","snapshot_observed_at":"2026-08-10T23:05:17.957362Z","submitted_at":"2025-01-18T20:17:31Z","title":"Mixture of Experts (MoE): A Big Data Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16352","snapshot_observed_at":"2026-08-07T12:11:09.882800Z","title":"Mixture of experts (moe): A big data perspective,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.882800Z"},"links":{"cited_paper":"/paper/2501.16352","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9113489f72de18754487ab421cb78f1d887add0759078a78f8bb3f092824b696","observation_id":"0b3d66c9-629a-4f0a-b757-1d14139289b9","resolution":{"observed_at":"2026-08-07T12:11:09.882800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06072","last_updated":"2025-08-01T01:52:05Z","snapshot_observed_at":"2026-08-09T18:57:28.644927Z","submitted_at":"2025-03-08T05:41:42Z","title":"A Survey on Post-training of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06072","snapshot_observed_at":"2026-08-07T12:11:09.974387Z","title":"A survey on post-training of large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.974387Z"},"links":{"cited_paper":"/paper/2503.06072","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:7d275353d37fe81326593c77a4425e308a5ed06a0c101398f07683dc87a1c41e","observation_id":"4e07f3b8-42ad-4c95-960f-c9b06133f978","resolution":{"observed_at":"2026-08-07T12:11:09.974387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:10.062753Z","title":"Ai for mathematics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:10.062753Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e9b374ef393f9306ec6a9ce3dd3a6265ae842bcde6796a0972d3599327835eab","observation_id":"1703d79e-8fba-40db-aff5-a08ceeaaafb4","resolution":{"observed_at":"2026-08-07T12:11:10.062753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10428","last_updated":"2025-04-05T13:51:05Z","snapshot_observed_at":"2026-08-10T04:50:00.918319Z","submitted_at":"2025-02-07T14:24:43Z","title":"Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning","version":4},"cited_work":{"arxiv_id":"2502.10428","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.10428","snapshot_observed_at":"2026-08-07T12:11:18.363214Z","title":"Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning","venue":"cs.AI","work_id":"ed94d463-1647-497d-8d45-018686975af8","year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:10.156882Z"},"links":{"cited_paper":"/paper/2502.10428","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:cdefabeee83a2299191d75ce74c48979a08f9c9bd8405c0c874ff329c5ddb6bc","observation_id":"ecad3f9b-6d8c-4f23-b9f3-98f63d458747","resolution":{"observed_at":"2026-08-07T12:11:18.461725Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:11:10.254632Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:10.254632Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:42143055d3e75775045c525a104c40d73923e567d2da6ad65a4db2605cd534c0","observation_id":"5939c403-35e4-41bb-a2d5-56fba4c69b7c","resolution":{"observed_at":"2026-08-07T12:11:10.254632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":167},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 167 outbound references and 0 inbound Pith citation observations for arXiv:2506.00309."}