{"as_of":"2026-08-14T13:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:52bbc87cb9ae11bf62832662239322a7e5972429959880634f99e7cb5c48ea0b","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:23:10.133741Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:26:42.768728Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T03:17:12.485198Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":"2505.19126","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19126","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"X., Sha, J., Wang, S., and Wen, J.-R","venue":null,"work_id":"f4b695d1-bd8c-436e-be6b-39d842709f0c","year":2025},"citing_paper":{"arxiv_id":"2604.09557","last_updated":"2026-05-28T14:40:40Z","snapshot_observed_at":"2026-08-10T22:40:12.860257Z","submitted_at":"2026-02-10T16:19:56Z","title":"SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-16T03:13:37.202362Z"},"links":{"cited_paper":"/paper/2505.19126","citing_paper":"/paper/2604.09557"},"observation_digest":"sha256:99a6838823c0f5ad0bd61ec383c5e02cf9ccdfbc8a3c92ae8dc5bc109aec3166","observation_id":"fee38c7d-2114-436a-8153-3ca423a47e4c","resolution":{"observed_at":"2026-05-16T03:17:12.489033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19126","snapshot_observed_at":"2026-08-03T02:40:56.699922Z","title":"X., Sha, J., Wang, S., and Wen, J.-R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.09557","last_updated":"2026-05-28T14:40:40Z","snapshot_observed_at":"2026-08-10T22:40:12.860257Z","submitted_at":"2026-02-10T16:19:56Z","title":"SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-03T02:40:56.699922Z"},"links":{"cited_paper":"/paper/2505.19126","citing_paper":"/paper/2604.09557"},"observation_digest":"sha256:8b272a35b43af9cbafd7629d4c5530fe7ac3a93529a5af10b11729c90fe4bbcc","observation_id":"b644681d-94d5-4bbd-8a3d-f67a22039223","resolution":{"observed_at":"2026-08-03T02:40:56.699922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19126","snapshot_observed_at":"2026-07-12T05:47:14.970921Z","title":"Mmath: A multilingual benchmark for mathematical reasoning.arXiv preprint arXiv:2505.19126, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02966","last_updated":"2026-07-09T05:23:35Z","snapshot_observed_at":"2026-08-12T21:53:21.913406Z","submitted_at":"2026-07-03T05:17:48Z","title":"Distill Where the Student Goes: Teacher-Regularized RL for English-Evidence Cross-Lingual RAG","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T05:47:14.970921Z"},"links":{"cited_paper":"/paper/2505.19126","citing_paper":"/paper/2607.02966"},"observation_digest":"sha256:bcc0256b360dab56627e00f03211eebb668386e5910ea25b28a34df54b7c57bb","observation_id":"a69d9326-96ba-4963-b369-ef162affe31f","resolution":{"observed_at":"2026-07-12T05:47:14.970921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19126","snapshot_observed_at":"2026-08-08T00:26:42.768728Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04160","last_updated":"2026-08-04T19:18:41Z","snapshot_observed_at":"2026-08-12T17:12:03.837946Z","submitted_at":"2026-08-04T19:18:41Z","title":"Mind the Cap: Output-Budget Regimes Change the Measured Multilingual Reasoning Gap","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T00:26:42.768728Z"},"links":{"cited_paper":"/paper/2505.19126","citing_paper":"/paper/2608.04160"},"observation_digest":"sha256:ba9a840ed86b2568e8e37b22171da2605b2dd9905b2545a4946ef95434c43005","observation_id":"81fbb081-c0dc-4e48-8e24-4b7ab22f42f4","resolution":{"observed_at":"2026-08-08T00:26:42.768728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19126/citation-record","integrity":"/paper/2505.19126/integrity","json":"/paper/2505.19126/citation-record.json","paper":"/paper/2505.19126"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:07.223255Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.223255Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:3d06a56024e60177b21d9c1c12825b91b21f3f0aa33fd46a97034316de5351a8","observation_id":"faa506d2-aa2b-4a3e-8526-74981245ec4b","resolution":{"observed_at":"2026-08-07T14:23:07.223255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:07.319369Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.319369Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:11ac2d9e1a4e51dbe8113d0d89439f9fe0000451c0a55d4718226fc25c1bc5cd","observation_id":"f9bb1444-3c18-4c89-9343-e84620db43b0","resolution":{"observed_at":"2026-08-07T14:23:07.319369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:23:07.419306Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.419306Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:853c82d9942770b89bb127d4372e32c30e27f87a05884f7736bf35349e1df8c9","observation_id":"d42a1fb3-7aa2-4e28-903a-417debff2521","resolution":{"observed_at":"2026-08-07T14:23:07.419306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-acl.608","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"1246ef8e-f767-4911-aabc-a304e69159d6","year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.582344Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:b96ad5cd4b267e9c5a17facf56bb76aca874d3a16075aa754aa3bc63cdb28214","observation_id":"610e64e9-88e7-472c-89b2-b6ff41872fb5","resolution":{"observed_at":"2026-08-07T14:23:10.371093Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20246","last_updated":"2024-10-16T04:26:04Z","snapshot_observed_at":"2026-08-13T05:36:51.831077Z","submitted_at":"2023-10-31T08:09:20Z","title":"Breaking Language Barriers in Multilingual Mathematical Reasoning: Insights and Observations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20246","snapshot_observed_at":"2026-08-07T14:23:07.637228Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.637228Z"},"links":{"cited_paper":"/paper/2310.20246","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:c5e4fd7a16da0a1a5ff0cae9406025eb54efcfc5540d59327d924d6d96bb5945","observation_id":"29eec08c-553b-4970-a66f-7eb8d63379be","resolution":{"observed_at":"2026-08-07T14:23:07.637228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T14:23:07.711092Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.711092Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:f17f8567eb67b5b4222ca6654f3f9d8c2a7db7e0c26ec4be7ca49954110b0ba9","observation_id":"1c99119c-9b7d-4720-a7bf-b4eefff3e969","resolution":{"observed_at":"2026-08-07T14:23:07.711092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-07T14:23:07.790787Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.790787Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:d5e079d3ea824312385a1ecf4f50fc6e9dac475557ee5f02c175d9e15b88f6e1","observation_id":"0d1651ab-a443-4e6d-92a5-b07ca33bdfa7","resolution":{"observed_at":"2026-08-07T14:23:07.790787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:07.850381Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.850381Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:037095c0dc3a7746d065c0d5889cf39220b1a4523b72de00d3357d4c2250eb1c","observation_id":"e2c51466-acd2-42fd-92de-0d7ff1590297","resolution":{"observed_at":"2026-08-07T14:23:07.850381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-13T10:02:20.024046Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T14:23:07.912353Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.912353Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:8cecb7f4ec45c6a0ed7585ff93be131a3b2a98b6b21dec44d315f43f216601bd","observation_id":"beb2dcd8-ce09-4a45-ac89-9df398fc6e18","resolution":{"observed_at":"2026-08-07T14:23:07.912353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-14T00:11:28.443916Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T14:23:07.990118Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:07.990118Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:b7a5a9b9f0af1477df7e1c347fc6b47bf4e4e3fe77db9537d8e57b5ff37832ac","observation_id":"55471775-4c12-4441-a108-254b5ab1853e","resolution":{"observed_at":"2026-08-07T14:23:07.990118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:23:08.053174Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.053174Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:cd8a4c5afa75b8e514bfc24fca9d863b9023bbc1a7cb70e8f4f73afd1bc6867d","observation_id":"32c5d370-a92a-4b7b-8c59-bfcdd142467e","resolution":{"observed_at":"2026-08-07T14:23:08.053174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:08.111443Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.111443Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:9617fa2b83534c014bfa62ee3bf76f8abdd2fb878645527182d06aee9f8936c1","observation_id":"1e227d06-36dc-4bc5-a09b-38fc76ba5451","resolution":{"observed_at":"2026-08-07T14:23:08.111443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07004","last_updated":"2023-10-22T13:43:27Z","snapshot_observed_at":"2026-08-13T13:44:06.302498Z","submitted_at":"2023-05-11T17:44:17Z","title":"Not All Languages Are Created Equal in LLMs: Improving Multilingual Capability by Cross-Lingual-Thought Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07004","snapshot_observed_at":"2026-08-07T14:23:08.157526Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.157526Z"},"links":{"cited_paper":"/paper/2305.07004","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:9872ecb65a23c826d18599ce9187b4b60f882e8f9a606c13e43fde0a036ea2a5","observation_id":"b37b26e2-b67f-4c2c-87da-1f79102a7642","resolution":{"observed_at":"2026-08-07T14:23:08.157526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T14:23:08.217262Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.217262Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:909ba30a166f3098fdccc32890a8f430e5d2f5e7e27f0f45dccaacec2246c825","observation_id":"db4b573f-4d08-4261-88db-8dadc65bd037","resolution":{"observed_at":"2026-08-07T14:23:08.217262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.01759","last_updated":"2016-08-09T17:38:43Z","snapshot_observed_at":"2026-08-14T01:16:52.740875Z","submitted_at":"2016-07-06T19:40:15Z","title":"Bag of Tricks for Efficient Text Classification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.01759","snapshot_observed_at":"2026-08-07T14:23:08.308482Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.308482Z"},"links":{"cited_paper":"/paper/1607.01759","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:151af3f504a2c14adeabec909cabfeafb67b9ad85a45f5e1ccd9a0056fac4687","observation_id":"6b2c6f7b-0ab2-4a10-b9f1-4f17005cc1ad","resolution":{"observed_at":"2026-08-07T14:23:08.308482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:08.368476Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.368476Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:97224d837068447ed6e355b0589fb89af9a04e2cf6cfe9ecae686ce87ee2065c","observation_id":"d0bc264c-1ac5-47e7-bd6b-1968c47dea47","resolution":{"observed_at":"2026-08-07T14:23:08.368476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10258","last_updated":"2025-04-21T12:52:49Z","snapshot_observed_at":"2026-08-13T20:13:09.000291Z","submitted_at":"2024-03-15T12:47:39Z","title":"Is Translation All You Need? A Study on Solving Multilingual Tasks with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10258","snapshot_observed_at":"2026-08-07T14:23:08.422758Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.422758Z"},"links":{"cited_paper":"/paper/2403.10258","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:14de596a4e663f8b0ddf376feabeef9d2e96a7b9ec570e901682a3c4c60f959b","observation_id":"1eb7bdee-0e00-438f-a4de-52dcb9460108","resolution":{"observed_at":"2026-08-07T14:23:08.422758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09858","last_updated":"2025-04-14T04:08:16Z","snapshot_observed_at":"2026-08-08T01:06:59.135762Z","submitted_at":"2025-04-14T04:08:16Z","title":"Reasoning Models Can Be Effective Without Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09858","snapshot_observed_at":"2026-08-07T14:23:08.495156Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.495156Z"},"links":{"cited_paper":"/paper/2504.09858","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:5219e0105d4f7a307b6561ec3b3948cd3774c6a0621aabfef58422aa888401ca","observation_id":"589b9465-e882-4848-9dc0-09c161c1b77e","resolution":{"observed_at":"2026-08-07T14:23:08.495156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-14T11:38:51.383664Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T14:23:08.556309Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.556309Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:bb3d5f82b5ba894d73530c47dda3250b09fc4eeec602cef964559a59168fe0d3","observation_id":"efa4c8ee-95e1-452f-a650-3558f40e8ed2","resolution":{"observed_at":"2026-08-07T14:23:08.556309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:11.351259Z","title":null,"venue":null,"work_id":"07873b39-290c-47cc-b0a2-718ca19158c4","year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.617520Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:a9417a74bc849a74930cc6432b27accfd6e6463cf2f32a4f11a05db795d2a169","observation_id":"794ae10f-fa8d-4bd6-9a50-2050619c9fad","resolution":{"observed_at":"2026-08-07T14:23:11.459453Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06195","last_updated":"2024-08-12T14:42:13Z","snapshot_observed_at":"2026-08-12T23:04:54.942566Z","submitted_at":"2024-08-12T14:42:13Z","title":"Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06195","snapshot_observed_at":"2026-08-07T14:23:08.712771Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.712771Z"},"links":{"cited_paper":"/paper/2408.06195","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:6fa19d9aac52366bc24ab35d520d38dabf76908cf557a7de8ebfe9c4926e3ff2","observation_id":"fa573d68-e3c0-47c5-adad-55b701f0db32","resolution":{"observed_at":"2026-08-07T14:23:08.712771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-07T14:23:08.841421Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.841421Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:9f921495a9872ecd690c675a0082589c65556075ea80d3677ba3ca951a4b4e2e","observation_id":"c1fe0051-f845-40d3-9347-097c4de6651e","resolution":{"observed_at":"2026-08-07T14:23:08.841421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T14:23:08.923407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:08.923407Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:99edf5223ad40e21318e4e551cea3b3c093066406db86e6448b48c4b5c422e6e","observation_id":"d4fcd452-97e8-4fc3-b96d-ee2e1016a693","resolution":{"observed_at":"2026-08-07T14:23:08.923407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17407","last_updated":"2025-08-01T10:09:29Z","snapshot_observed_at":"2026-08-11T04:21:33.873916Z","submitted_at":"2025-02-24T18:36:15Z","title":"Linguistic Generalizability of Test-Time Scaling in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17407","snapshot_observed_at":"2026-08-07T14:23:09.002273Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.002273Z"},"links":{"cited_paper":"/paper/2502.17407","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:aa5af17c065ddae358c7eaabb7ce72d26de462f7c48cb0e5f99a322804f53674","observation_id":"ebac370d-ca9a-474f-8cf2-bfda196efe5f","resolution":{"observed_at":"2026-08-07T14:23:09.002273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:09.117873Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.117873Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:557343b5204e3221b7cb1ac3c50b870bef1d25f4c6cd86b40926b4984a41e24b","observation_id":"191f0673-c489-48a0-8f6c-9d1952029b8e","resolution":{"observed_at":"2026-08-07T14:23:09.117873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:09.205941Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.205941Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:47eb84166e173f04510f49c29b783ddedf40569d5414adc9da10b8fcdf2dbe71","observation_id":"685c80a3-b760-4492-bde7-4d7997b0229e","resolution":{"observed_at":"2026-08-07T14:23:09.205941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:09.298148Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.298148Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:7c8ec8999f29829f72568286f73ec999077374626cd7da6a78ff119c42fdde4e","observation_id":"ec258b61-05ac-477c-8d8d-1486ee25ea6f","resolution":{"observed_at":"2026-08-07T14:23:09.298148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10460","last_updated":"2025-05-28T12:32:29Z","snapshot_observed_at":"2026-08-10T16:59:28.676649Z","submitted_at":"2025-03-13T15:29:22Z","title":"Light-R1: Curriculum SFT, DPO and RL for Long COT from Scratch and Beyond","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10460","snapshot_observed_at":"2026-08-07T14:23:09.386204Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.386204Z"},"links":{"cited_paper":"/paper/2503.10460","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:fbe77e365f6e8c7f9d332eb3b346fef9d59e191f989b6c897101b32ddf2bf0c2","observation_id":"d83f6548-a7f5-4fd5-aba7-4754a97c478f","resolution":{"observed_at":"2026-08-07T14:23:09.386204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24370","last_updated":"2025-05-21T17:51:27Z","snapshot_observed_at":"2026-08-07T16:20:08.878901Z","submitted_at":"2025-03-31T17:50:13Z","title":"Effectively Controlling Reasoning Models through Thinking Intervention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24370","snapshot_observed_at":"2026-08-07T14:23:09.580989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.580989Z"},"links":{"cited_paper":"/paper/2503.24370","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:6adadc0e444ac98c4c068bd5b281990e0eee9898526b734c363ae3d2ebb14ee6","observation_id":"d237930a-78fb-4b51-bb5d-f42005eae2c3","resolution":{"observed_at":"2026-08-07T14:23:09.580989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03789","last_updated":"2023-12-06T12:03:27Z","snapshot_observed_at":"2026-08-14T08:27:51.393081Z","submitted_at":"2023-12-06T12:03:27Z","title":"Comparative Analysis of Multilingual Text Classification & Identification through Deep Learning and Embedding Visualization","version":1},"cited_work":{"arxiv_id":"2312.03789","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.03789","snapshot_observed_at":"2026-08-07T14:23:10.562692Z","title":"Comparative Analysis of Multilingual Text Classification & Identification through Deep Learning and Embedding Visualization","venue":"cs.CL","work_id":"6a0b8406-af67-43c5-9dba-9093319d2927","year":2023},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.687067Z"},"links":{"cited_paper":"/paper/2312.03789","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:0af666efdff10a34c88d71fa1dd4f97ed92fa13f88d18896bbfe86e4ae0d36e6","observation_id":"6c2cd4ee-c235-4434-b638-0e4889e72399","resolution":{"observed_at":"2026-08-07T14:23:10.671051Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:23:09.768699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.768699Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:0022f0275e48e28afe76e5c1058f6b38fc072b16a8ba65aa417b8748f0b06536","observation_id":"a7a3f426-33c1-4464-8b6b-16fa487877a7","resolution":{"observed_at":"2026-08-07T14:23:09.768699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-07T14:23:09.891236Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:09.891236Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:2e02317f045f935f32af53e6eaef47aecd5dcfa8a65760ef4017a71555e3cfd8","observation_id":"66aaff17-d5f3-4014-8218-b5098907cdc5","resolution":{"observed_at":"2026-08-07T14:23:09.891236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01981","last_updated":"2024-12-02T21:20:02Z","snapshot_observed_at":"2026-08-11T23:55:34.185936Z","submitted_at":"2024-12-02T21:20:02Z","title":"Free Process Rewards without Process Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01981","snapshot_observed_at":"2026-08-07T14:23:10.024650Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:10.024650Z"},"links":{"cited_paper":"/paper/2412.01981","citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:5fdbdcf4374dc019ce7da27292249b76afee3a0581c83c9c9fcc77e3adec558c","observation_id":"43119fe8-f441-4f24-8e83-b64b3161fbc1","resolution":{"observed_at":"2026-08-07T14:23:10.024650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:10.133741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:23:10.133741Z"},"links":{"citing_paper":"/paper/2505.19126"},"observation_digest":"sha256:d41e4efb92bc31266fa6c8693543a70b75f64d0babfbf06a1e88562c7b4e7bb6","observation_id":"8b4f4181-d43d-4af0-9aee-6f82af50aa14","resolution":{"observed_at":"2026-08-07T14:23:10.133741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19126","last_updated":"2025-05-25T12:47:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T11:06:54.014327Z","submitted_at":"2025-05-25T12:47:39Z","title":"MMATH: A Multilingual Benchmark for Mathematical Reasoning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 4 inbound Pith citation observations for arXiv:2505.19126."}