{"as_of":"2026-08-17T21:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b25572e9e03d9ca2c35fb482c29593c9054b45a4453b934f0b01ae1ed9e7ebc1","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:08:00.731058Z","state":"measured"},{"denominator":86,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":86,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:55:27.736254Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"cited_work":{"arxiv_id":"2505.05408","doi":"10.48550/arxiv.2505.05408","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crosslingual Reasoning through Test-Time Scaling , journal =","venue":"ArXiv.org","work_id":"53916003-c6d6-4691-ba7d-7cb30312123a","year":2025},"citing_paper":{"arxiv_id":"2505.14990","last_updated":"2026-04-23T19:31:56Z","snapshot_observed_at":"2026-08-14T14:40:12.432273Z","submitted_at":"2025-05-21T00:31:13Z","title":"Language Specific Knowledge: Do Models Know Better in X than in English?","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T14:48:29.590965Z"},"links":{"cited_paper":"/paper/2505.05408","citing_paper":"/paper/2505.14990"},"observation_digest":"sha256:75c273eda4e23492aee723b8fdfd6e578be2aecf8b21c0cf38c07c6f04d05768","observation_id":"bbb98af1-5c7c-4f69-a858-41de547fd90f","resolution":{"observed_at":"2026-05-22T14:51:42.702671Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05408","snapshot_observed_at":"2026-08-07T14:55:27.736254Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17021","last_updated":"2025-05-22T17:59:58Z","snapshot_observed_at":"2026-08-08T11:44:17.973390Z","submitted_at":"2025-05-22T17:59:58Z","title":"ARB: A Comprehensive Arabic Multimodal Reasoning Benchmark","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:27.736254Z"},"links":{"cited_paper":"/paper/2505.05408","citing_paper":"/paper/2505.17021"},"observation_digest":"sha256:c5f77183a35105aef6ac5cf9519b197313a6685b84874d26275919e7258f3bd4","observation_id":"c6a56755-adc8-461d-b385-43969dc9683d","resolution":{"observed_at":"2026-08-07T14:55:27.736254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05408","snapshot_observed_at":"2026-08-07T12:40:28.238008Z","title":"Crosslingual reasoning through test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24119","last_updated":"2025-05-30T01:32:44Z","snapshot_observed_at":"2026-08-17T03:04:32.907429Z","submitted_at":"2025-05-30T01:32:44Z","title":"The State of Multilingual LLM Safety Research: From Measuring the Language Gap to Mitigating It","version":1},"reference_index":140,"source":"arxiv_source","source_observed_at":"2026-08-07T12:40:28.238008Z"},"links":{"cited_paper":"/paper/2505.05408","citing_paper":"/paper/2505.24119"},"observation_digest":"sha256:1f8d1e022b35b42f55d3a7dcf0b7024e4ac2212222fbfcf548625c2556133518","observation_id":"f929a16c-a01e-47f1-8449-ec7209d572a0","resolution":{"observed_at":"2026-08-07T12:40:28.238008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"cited_work":{"arxiv_id":"2505.05408","doi":"10.48550/arxiv.2505.05408","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crosslingual Reasoning through Test-Time Scaling , journal =","venue":"ArXiv.org","work_id":"53916003-c6d6-4691-ba7d-7cb30312123a","year":2025},"citing_paper":{"arxiv_id":"2604.21593","last_updated":"2026-05-03T05:05:27Z","snapshot_observed_at":"2026-08-16T09:49:57.029547Z","submitted_at":"2026-04-23T12:19:14Z","title":"Language as a Latent Variable for Reasoning Optimization","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-09T21:40:37.499246Z"},"links":{"cited_paper":"/paper/2505.05408","citing_paper":"/paper/2604.21593"},"observation_digest":"sha256:63771c6fbd52528643d01689d03f9bb7c12b9c703ec4852a33f4180d8558b609","observation_id":"dd5f3866-04b2-49e0-a982-4031a41ee8ad","resolution":{"observed_at":"2026-05-11T14:31:06.570780Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"cited_work":{"arxiv_id":"2505.05408","doi":"10.48550/arxiv.2505.05408","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crosslingual Reasoning through Test-Time Scaling , journal =","venue":"ArXiv.org","work_id":"53916003-c6d6-4691-ba7d-7cb30312123a","year":2025},"citing_paper":{"arxiv_id":"2605.19173","last_updated":"2026-05-18T22:55:21Z","snapshot_observed_at":"2026-08-17T20:50:24.613772Z","submitted_at":"2026-05-18T22:55:21Z","title":"Prompting language influences diagnostic reasoning and accuracy of large language models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T10:24:30.749958Z"},"links":{"cited_paper":"/paper/2505.05408","citing_paper":"/paper/2605.19173"},"observation_digest":"sha256:8eba3c9f3d0b858f8baac912624076ed4a862cde67a24e14b308f37940ff9e41","observation_id":"baab054c-e75c-4ba4-b9ad-c4b84b9c1ac5","resolution":{"observed_at":"2026-05-20T10:28:12.479499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"cited_work":{"arxiv_id":"2505.05408","doi":"10.48550/arxiv.2505.05408","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crosslingual Reasoning through Test-Time Scaling , journal =","venue":"ArXiv.org","work_id":"53916003-c6d6-4691-ba7d-7cb30312123a","year":2025},"citing_paper":{"arxiv_id":"2605.22567","last_updated":"2026-05-21T14:47:52Z","snapshot_observed_at":"2026-08-16T17:36:50.516706Z","submitted_at":"2026-05-21T14:47:52Z","title":"LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-22T06:19:44.377733Z"},"links":{"cited_paper":"/paper/2505.05408","citing_paper":"/paper/2605.22567"},"observation_digest":"sha256:0fb6edafb1629a30fa8197c1f768ffc2aa668d0d2dceba3a2016c824ddd2c1f2","observation_id":"30689f68-2d9f-4fe7-981c-5de38d68dd74","resolution":{"observed_at":"2026-05-22T06:21:09.735534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"cited_work":{"arxiv_id":"2505.05408","doi":"10.48550/arxiv.2505.05408","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Crosslingual Reasoning through Test-Time Scaling , journal =","venue":"ArXiv.org","work_id":"53916003-c6d6-4691-ba7d-7cb30312123a","year":2025},"citing_paper":{"arxiv_id":"2606.26466","last_updated":"2026-06-25T00:01:58Z","snapshot_observed_at":"2026-08-14T14:29:57.670463Z","submitted_at":"2026-06-25T00:01:58Z","title":"Soft Token Alignment for Cross-Lingual Reasoning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-26T05:43:20.437278Z"},"links":{"cited_paper":"/paper/2505.05408","citing_paper":"/paper/2606.26466"},"observation_digest":"sha256:2fc8109c98d4ebdcf0e1bb09f8a2e566eb52826ccbf8cd9d6eea416b2a7e9ffd","observation_id":"aae947fd-b0ca-46a6-9cc6-a545f606909d","resolution":{"observed_at":"2026-07-04T12:59:52.109759Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05408","snapshot_observed_at":"2026-07-14T14:12:44.286699Z","title":"Farid Adilazuarda, Jonibek Mansurov, Ruochen Zhang, Niklas Muennighoff, Carsten Eickhoff, Genta Indra Winata, Julia Kreutzer, Stephen H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10114","last_updated":"2026-07-11T04:30:43Z","snapshot_observed_at":"2026-08-15T08:20:20.557315Z","submitted_at":"2026-07-11T04:30:43Z","title":"Cost of Reasoning in non-English Languages: A Case Study on Japanese","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-14T14:12:44.286699Z"},"links":{"cited_paper":"/paper/2505.05408","citing_paper":"/paper/2607.10114"},"observation_digest":"sha256:b8a1ea9681cbaed9c68f919a05a1486a6d7c1105a7d51d1a9f08d41f171f3418","observation_id":"7a8bee9a-4abb-4eb7-ba52-9cd2ea191ff0","resolution":{"observed_at":"2026-07-14T14:12:44.286699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.05408/citation-record","integrity":"/paper/2505.05408/integrity","json":"/paper/2505.05408/citation-record.json","paper":"/paper/2505.05408"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-15T23:08:00.347215Z","title":"Scaling llm test-time compute opti- mally can be more effective than scaling model parameters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.347215Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:320d812e42e00851cdb01764753e22fbf1203645c2652f2f1cfa92fd79a44358","observation_id":"5c226e72-5596-4ff4-bac7-d5ce44e0736d","resolution":{"observed_at":"2026-08-15T23:08:00.347215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-08-14T10:00:52.343929Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-15T23:08:00.354200Z","title":"Large language monkeys: Scaling inference compute with repeated sampling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.354200Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:ae23bb30871499185b2abd267b7fcbbe36868f2361a8b1c13143d6be1aa99dee","observation_id":"d0c5a047-cf59-46e1-8efb-b890d9fe1e46","resolution":{"observed_at":"2026-08-15T23:08:00.354200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-08-13T03:06:10.986532Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-08-15T23:08:00.359981Z","title":"Inference scaling laws: An empirical analysis of compute-optimal inference for problem-solving with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.359981Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:48b3ff14c51be9d9360ba2a77855926bdfcfa650d03c133a1a9e4153d739db19","observation_id":"516bf54f-237c-4363-9fcf-cbab9a04ec3e","resolution":{"observed_at":"2026-08-15T23:08:00.359981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16377","last_updated":"2024-12-07T22:50:41Z","snapshot_observed_at":"2026-08-16T13:07:16.365767Z","submitted_at":"2024-10-21T18:00:06Z","title":"A Simple Model of Inference Scaling Laws","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16377","snapshot_observed_at":"2026-08-15T23:08:00.365205Z","title":"A simple model of inference scaling laws","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.365205Z"},"links":{"cited_paper":"/paper/2410.16377","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:29dfe929f6efb55c4f3c191804b5c881a6d2f8ae3be3becacaf9d249ba4bf7bb","observation_id":"94a9e3c3-f245-4b61-b516-ed6affaaa682","resolution":{"observed_at":"2026-08-15T23:08:00.365205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T23:08:00.370482Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.370482Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:ddb7c55fb958547a52cb8f383aac9929a0d4ed84d5ba87b7baad3842802f5a1e","observation_id":"7f1c115f-e392-4520-926a-75e357c6d802","resolution":{"observed_at":"2026-08-15T23:08:00.370482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-15T23:08:00.375882Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.375882Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:d3321f017e5a4b9e7327357ebde6a05f3d48abdf0346747ba93206f483a5a9d3","observation_id":"1d84dd28-f3cc-417f-ae0f-79e4937e7343","resolution":{"observed_at":"2026-08-15T23:08:00.375882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:02.022920Z","title":"Openai o3 and o4-mini system card","venue":null,"work_id":"1d87c2a1-fcda-4687-960c-230c04914a47","year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.382184Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:debc1274854164ced13b3349ebfe0fd498eceefc40a323acabfba25d200e655c","observation_id":"e371c722-799f-469d-854c-0011ac9a5235","resolution":{"observed_at":"2026-08-15T23:08:02.029517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-15T23:08:00.387298Z","title":"Towards reasoning era: A survey of long chain-of-thought for reasoning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.387298Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:3e15e52c50d435bb64e6cdfafc4dd950a134ab2da50f9a03966c03c7f35cfa3d","observation_id":"64d3d8b5-6666-40f0-b16b-fc6a942e6655","resolution":{"observed_at":"2026-08-15T23:08:00.387298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-17T11:00:39.333660Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-15T23:08:00.393139Z","title":"s1: Simple test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.393139Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:2d7a61f56cf79d22692f4fe39f430397231728877a14e4cc762ed34e86b6f11d","observation_id":"d2d78fea-1f00-443c-9afc-7fbbba27738f","resolution":{"observed_at":"2026-08-15T23:08:00.393139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-15T23:08:00.398411Z","title":"Limo: Less is more for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.398411Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:f16af1bd4f1831d57fd5ddf8346dc6645f5d21feecac352a02d350963bcf4305","observation_id":"1977189d-2ae8-47b2-aa8a-813a084efe6d","resolution":{"observed_at":"2026-08-15T23:08:00.398411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:02.002571Z","title":"The multilingual mind : A survey of multilingual reasoning in language models, 2025","venue":null,"work_id":"a381c74a-a693-4b71-8d71-4775989d75f7","year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.403327Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:ece9a51027609d78888996dcf8731ea7d06c3ae8eb738d76975e2e3377846319","observation_id":"06ec4f4b-f10b-4e6e-9316-b1c7927185fa","resolution":{"observed_at":"2026-08-15T23:08:02.008119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-10T17:58:02.856512Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-15T23:08:00.407935Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.407935Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:2b70be480953fc2314aee5f72d7be03987682dab32e479ca130c5bec613ef5ca","observation_id":"0acc2b47-6932-4b8d-9247-59192bbe8256","resolution":{"observed_at":"2026-08-15T23:08:00.407935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-17T06:12:37.525438Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-15T23:08:00.413953Z","title":"Training large language models to reason in a continuous latent space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.413953Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:c326b0eb59a1e7f9c6dc84463dc124006708e04f75610f4c59b30c8ca5b03ba1","observation_id":"eb9f13d0-58e3-4a2b-b398-ad4e7f3ebe08","resolution":{"observed_at":"2026-08-15T23:08:00.413953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.986321Z","title":"Critic: Large language models can self-correct with tool-interactive critiquing","venue":null,"work_id":"3d338966-b699-4666-b360-4c500ca13d45","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.419580Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:bd794b058bb996a3656adec8aeb09fc659b98d27f5b540b52307f219a0d38ce9","observation_id":"cd4af6b3-da47-4e37-9b20-3cff53ccabb8","resolution":{"observed_at":"2026-08-15T23:08:01.991358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04682","last_updated":"2025-01-08T18:42:48Z","snapshot_observed_at":"2026-08-17T00:54:00.358623Z","submitted_at":"2025-01-08T18:42:48Z","title":"Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04682","snapshot_observed_at":"2026-08-15T23:08:00.424521Z","title":"Towards system 2 reasoning in llms: Learning how to think with meta chain-of-though","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.424521Z"},"links":{"cited_paper":"/paper/2501.04682","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:2fb1aac0823304bdeb57fc1211eb02dba834607af5fcd29b0c350fd0cdabb904","observation_id":"007cd9e1-c964-4d72-b0c1-324c490d9653","resolution":{"observed_at":"2026-08-15T23:08:00.424521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T23:08:00.429958Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.429958Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:5608045abe88c6b48f76858c22f66149cbad93054ae68e327cafa92f0693fb3e","observation_id":"70f4b1c1-b9ad-4495-9d6e-c03e32f9205a","resolution":{"observed_at":"2026-08-15T23:08:00.429958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17407","last_updated":"2025-08-01T10:09:29Z","snapshot_observed_at":"2026-08-16T12:55:37.965786Z","submitted_at":"2025-02-24T18:36:15Z","title":"Linguistic Generalizability of Test-Time Scaling in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17407","snapshot_observed_at":"2026-08-15T23:08:00.434873Z","title":"Linguistic generalizability of test-time scaling in mathematical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.434873Z"},"links":{"cited_paper":"/paper/2502.17407","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:bf6ec3c9f3248e4c66e44b4036d2941f0f475634b0ff09fb28474ad5cbe3f23c","observation_id":"1e052f73-eaf9-4c51-9c9b-09a2fc4c5a9c","resolution":{"observed_at":"2026-08-15T23:08:00.434873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.440062Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.440062Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:280345b863ac41985153ad02c718d9b55df7ad1f04c553437fe2c62aec1417f9","observation_id":"0764cfe7-825c-41d8-84e4-986d4fff323c","resolution":{"observed_at":"2026-08-15T23:08:00.440062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.444811Z","title":"Program induction by rationale generation: Learning to solve and explain algebraic word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.444811Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:d383134b7c7e2eddb11ca8c15933ef0769d9b029f88f88be1df26a4274df4f01","observation_id":"df3335de-51ba-4e48-98a9-8904eb792d36","resolution":{"observed_at":"2026-08-15T23:08:00.444811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T23:08:00.455968Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.455968Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:06b16972a6afcdd7e97047934eb19a87f80c7a4eac64ebf201889a20ac1d71e7","observation_id":"7f438d41-d641-41bd-ad7f-452e52249539","resolution":{"observed_at":"2026-08-15T23:08:00.455968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00114","last_updated":"2021-11-30T21:32:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-30T21:32:46Z","title":"Show Your Work: Scratchpads for Intermediate Computation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00114","snapshot_observed_at":"2026-08-15T23:08:00.460959Z","title":"Show your work: Scratchpads for intermediate computation with language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.460959Z"},"links":{"cited_paper":"/paper/2112.00114","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:e7f6e1eaf9ef7a9e6e021dde678c8236530d18675fb49b7b9b701f65cee357ce","observation_id":"eeb25427-bcab-4dfd-bfc8-d669d59d10af","resolution":{"observed_at":"2026-08-15T23:08:00.460959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.937964Z","title":"Chain of thought empowers transformers to solve inherently serial problems","venue":null,"work_id":"3a453c0c-be5e-49b5-a62f-e0763fe7b228","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.465739Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:74ce2dff4fe1530ef4b1293aceb1e2847d3886dcebdbe4bd3bd14574eb4bf78d","observation_id":"0520dd9c-e99a-4ff0-93f4-fcf68b5f0946","resolution":{"observed_at":"2026-08-15T23:08:01.943879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-08-14T13:46:28.086398Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-15T23:08:00.470291Z","title":"Cognitive behaviors that enable self-improving reasoners, or, four habits of highly effective stars","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.470291Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:25dd3e59605afe46749bd0f85f2222f068601b77e5f42ffe2fdd8ab0469f3a88","observation_id":"74e7799f-e0b8-4908-8b36-980dac921ce8","resolution":{"observed_at":"2026-08-15T23:08:00.470291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09891","last_updated":"2025-01-17T00:41:44Z","snapshot_observed_at":"2026-08-15T02:23:45.719567Z","submitted_at":"2025-01-17T00:41:44Z","title":"Evolving Deeper LLM Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09891","snapshot_observed_at":"2026-08-15T23:08:00.475080Z","title":"Evolving deeper llm thinking","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.475080Z"},"links":{"cited_paper":"/paper/2501.09891","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:c3c8b47bbcef6aeef27f9d848721831dabe1c66ab00b67b0a4a9f01d1d8f2141","observation_id":"72fc66bc-3a79-42d0-94a3-1ef194fbea7a","resolution":{"observed_at":"2026-08-15T23:08:00.475080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-13T15:08:13.316080Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-15T23:08:00.481057Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson? arXiv preprint arXiv:2411.16489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.481057Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:ed0912ec8764f4fab58c021d00d7386f2ea43bdaa7931dac44b02cf0f7b10554","observation_id":"fa15ad93-73f0-469b-887e-3b1abbcd8c2b","resolution":{"observed_at":"2026-08-15T23:08:00.481057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.486032Z","title":"Bespoke-stratos: The unreasonable effectiveness of reasoning distilla- tion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.486032Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:f8b8334877405141300aaed8da6b024868e82adac4a1d2479172bbfc6d57e932","observation_id":"b057238c-9ad2-4fb5-b571-500180286167","resolution":{"observed_at":"2026-08-15T23:08:00.486032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.490717Z","title":"Millions scale dataset distilled from r1-32b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.490717Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:ab9f9e4824a64a75a9bd1c56089f87638a380b91915b426651e4de7378a50558","observation_id":"5b3a0392-1a53-405f-b3a7-d9be978e2a19","resolution":{"observed_at":"2026-08-15T23:08:00.490717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.900562Z","title":"Tina: Tiny reasoning models via lora","venue":null,"work_id":"a67dc252-b978-4492-9ff9-71c40700b1fa","year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.495354Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:4b6e8218aec67a19c58130638e1713390767408a1f68c9c790a422f0182842b4","observation_id":"6cadb4e2-c438-42dc-9f89-e28237972b87","resolution":{"observed_at":"2026-08-15T23:08:01.905542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T23:08:00.499987Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.499987Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:50e3a77ab92146b5e6342463715eec1fcdc3b4a304a987a62d230a0e0e783337","observation_id":"b02139bd-10b4-4d54-acaa-d220ef10d13c","resolution":{"observed_at":"2026-08-15T23:08:00.499987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.504329Z","title":"Think before you speak: Training language models with pause tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.504329Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:4b15550b650581442ce7ab2c310828c2bf87de546f0853aa6230655c5bb0d040","observation_id":"2f5da101-1b94-4f59-a6bd-8235f9e17842","resolution":{"observed_at":"2026-08-15T23:08:00.504329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.873869Z","title":"Language models are multilingual chain-of-thought reasoners","venue":null,"work_id":"94e234ee-b41c-47a1-86fc-1e8d6834ad8e","year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.509040Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:5e3bdec1a4d89f6267b7be0965815b9a4fdb7948b6f5257cbd961e7d2fee5516","observation_id":"5eed85ec-2ebc-486e-944e-dcdd8120cc31","resolution":{"observed_at":"2026-08-15T23:08:01.878920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.856843Z","title":"Cross-lingual prompting: Improving zero-shot chain-of-thought reasoning across languages","venue":null,"work_id":"4a06d4ea-01af-4c1d-aecd-cad246a9e422","year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.513637Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:2d939612dfa3f75248e6c19e857b3ae1626d2378e3b8058f1b970d7374a0ecf3","observation_id":"ecc9e832-c3e0-40be-a3de-3fbc3672e6d4","resolution":{"observed_at":"2026-08-15T23:08:01.862182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.839057Z","title":"Question translation training for better multilingual reasoning","venue":null,"work_id":"75b462f0-dcef-4569-8756-b61edcd96c5e","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.518466Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:59316fdd119e43df5275224ac0b812e40275a407f506d1abc827c6d93ac63768","observation_id":"3dd01407-6afd-4be5-8c2f-e989d9376cb4","resolution":{"observed_at":"2026-08-15T23:08:01.845065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02448","last_updated":"2025-01-31T07:32:07Z","snapshot_observed_at":"2026-08-16T12:59:42.986521Z","submitted_at":"2025-01-05T05:57:22Z","title":"Understand, Solve and Translate: Bridging the Multilingual Mathematical Reasoning Gap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02448","snapshot_observed_at":"2026-08-15T23:08:00.523233Z","title":"Understand, solve and translate: Bridging the multilingual mathematical reasoning gap","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.523233Z"},"links":{"cited_paper":"/paper/2501.02448","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:f7d67fad633e5c9897d02444cbf3f9bb48f698d37093288bec6a9de490d7f7f3","observation_id":"2acf8cb6-1bdd-46de-a354-730ed2075c48","resolution":{"observed_at":"2026-08-15T23:08:00.523233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.822023Z","title":"LangBridge: Multilingual reasoning without multilingual supervision","venue":null,"work_id":"fa444a67-87c2-4c3a-8486-a326d766d45c","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.528607Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:ac398fb01dc81a25c242fe48e44f4aeafbf72a1c2bde97e627152d1194b6edcc","observation_id":"3b6afc4f-3825-4aa3-8c26-752fcd3cae8f","resolution":{"observed_at":"2026-08-15T23:08:01.827441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.805648Z","title":"Mindmerger: Efficiently boosting LLM reasoning in non-english languages","venue":null,"work_id":"79115f1b-f864-4204-a5ba-ccb0215958ae","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.533615Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:6c2fdf8c0880db377e2b11589610d74633c6235899c2f0b66b0e704ca67074ba","observation_id":"fece9867-8a65-4a66-8fef-7317f7e906ff","resolution":{"observed_at":"2026-08-15T23:08:01.810692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.789541Z","title":"MAPO: Advancing multilingual reasoning through multilingual-alignment-as-preference optimization","venue":null,"work_id":"e9da5f4e-1f1d-415c-a1dc-96a79f174d77","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.538643Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:ba81858c4739a8d0b7f0cfa17dd84faf721200bce785cd14c99e82a4173ea220","observation_id":"f9a32539-2947-446b-b6bb-74ab7c389de4","resolution":{"observed_at":"2026-08-15T23:08:01.794602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.773286Z","title":"Language imbalance driven rewarding for multilingual self-improving","venue":null,"work_id":"daf03127-c88d-4bc3-84c9-fa86744bc3ca","year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.543521Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:6ac004a6a2d6babf963be11d0f8c0e4a1e39ebb6b891d86da8d3771b2f5501d6","observation_id":"81707aae-6fd5-4846-8823-a226c1df4b1a","resolution":{"observed_at":"2026-08-15T23:08:01.778277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20246","last_updated":"2024-10-16T04:26:04Z","snapshot_observed_at":"2026-08-16T14:47:20.015594Z","submitted_at":"2023-10-31T08:09:20Z","title":"Breaking Language Barriers in Multilingual Mathematical Reasoning: Insights and Observations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20246","snapshot_observed_at":"2026-08-15T23:08:00.548452Z","title":"Breaking language barriers in multilingual mathematical reasoning: Insights and observations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.548452Z"},"links":{"cited_paper":"/paper/2310.20246","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:895fac1035b41ba9d2cd0e7bedc94c19e51cda186627cfba8305656c70f047a4","observation_id":"e0b07b3b-4ee4-4fc9-82cf-da826fdda5f2","resolution":{"observed_at":"2026-08-15T23:08:00.548452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08385","last_updated":"2025-07-22T23:36:25Z","snapshot_observed_at":"2026-08-16T13:10:31.699167Z","submitted_at":"2024-10-10T21:44:56Z","title":"Language model developers should report train-test overlap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08385","snapshot_observed_at":"2026-08-15T23:08:00.553488Z","title":"Language model developers should report train-test overlap","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.553488Z"},"links":{"cited_paper":"/paper/2410.08385","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:b0d5148bf95ac09dbe7cbc0c2e27d92ebccb5e39b06cff2ebf1a55ed01b66d5f","observation_id":"fe1787ce-433b-43eb-b9b2-f4fe6da952de","resolution":{"observed_at":"2026-08-15T23:08:00.553488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.757371Z","title":null,"venue":null,"work_id":"c7659251-1b88-4e7d-b03b-018250095d9e","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.558933Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:7119df09caf92ba306c0a3d80bf5aed55e95be6e48f315b7cef02b1f2e982df5","observation_id":"72db4342-d5fb-488e-a255-0b6f62d2810d","resolution":{"observed_at":"2026-08-15T23:08:01.762396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.563492Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.563492Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:cc86236373e7d377b635a788158f0ae186456a0e2ac64a03af79051a3c87aec2","observation_id":"185b32b3-61be-4cff-9e80-05ce8c03b454","resolution":{"observed_at":"2026-08-15T23:08:00.563492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.729890Z","title":"FORK: A bite-sized test set for probing culinary cultural biases in commonsense reasoning models","venue":null,"work_id":"323b5b62-df62-4c75-8e55-4007d372c53c","year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.568207Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:0d546c2427afc802f36e86df8a15705e763ae1469680423555cfb2c026489610","observation_id":"a8be1b13-1a4e-487d-9564-4d1864df9684","resolution":{"observed_at":"2026-08-15T23:08:01.735254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.572782Z","title":"CommonsenseQA: A question answering challenge targeting commonsense knowledge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.572782Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:f9d91b7fbb022c5173a694934b2b3e6833c466af11885fe94a8e819991d3f515","observation_id":"ab505657-b99c-4ee2-a989-9bcae0f1dfbb","resolution":{"observed_at":"2026-08-15T23:08:00.572782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.702690Z","title":"COPAL- ID: Indonesian language reasoning with local culture and nuances","venue":null,"work_id":"3b6253ac-a808-4587-8620-020af63e9191","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.577263Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:0481ca42a922d654c45d0a31bdbebf1606d554c1a57a8031c0c963bea0d6ff9d","observation_id":"0d39e314-adbe-498f-9b61-d87cb78545d8","resolution":{"observed_at":"2026-08-15T23:08:01.708348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.686259Z","title":"Choice of plausible alterna- tives: An evaluation of commonsense causal reasoning","venue":null,"work_id":"4f01dba2-01e7-4205-8474-0e694458620a","year":2011},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.581780Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:e1ac43829f3411de1e264152870a60cd38d70b7a9d5b890bec6b4330eb205319","observation_id":"616e5740-c45a-46cd-9475-9695bff95a60","resolution":{"observed_at":"2026-08-15T23:08:01.691708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.586668Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.586668Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:9f64d577193842f3a001a8b9a5ae68a9ba788c5157e500abef59858ff5b9aaaf","observation_id":"0f260dfe-0f1f-4c6e-b68a-e871d71dd550","resolution":{"observed_at":"2026-08-15T23:08:00.586668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-07T14:43:09.380195Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-15T23:08:00.591261Z","title":"Mammoth: Building math generalist models through hybrid instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.591261Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:ea6c0cb196f04fd5a048d1b9a5cb0e16ecfc337f928da5c593e55c7fe7815c29","observation_id":"769e99e8-af4f-44d6-bd5a-d01074ffc475","resolution":{"observed_at":"2026-08-15T23:08:00.591261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.658025Z","title":"SLAM: Towards efficient multilingual reasoning via selective language alignment","venue":null,"work_id":"5185223b-ac47-46a4-8d68-566e2f12edd8","year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.596599Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:337ed53487d21605ff4297b53fc0f3848cd0a29e30d714b1a0a305fbd3e5fff7","observation_id":"949d3b87-c155-4382-a776-7d7dede4d523","resolution":{"observed_at":"2026-08-15T23:08:01.664871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-15T23:08:00.601436Z","title":"Gemma 3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.601436Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:5b8fd839a21bb9b961a91f78aaab7b3d873fb38dccf4e450a64bd59e275a935d","observation_id":"1cc88bbf-b27c-41fe-872e-73767d91d967","resolution":{"observed_at":"2026-08-15T23:08:00.601436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00448","last_updated":"2025-04-14T10:11:13Z","snapshot_observed_at":"2026-08-16T14:30:39.251880Z","submitted_at":"2023-12-31T10:53:58Z","title":"Beyond Chinchilla-Optimal: Accounting for Inference in Language Model Scaling Laws","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00448","snapshot_observed_at":"2026-08-15T23:08:00.606321Z","title":"Beyond chinchilla-optimal: Accounting for inference in language model scaling laws","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.606321Z"},"links":{"cited_paper":"/paper/2401.00448","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:27ebc90ef3b8e5b80548a71ed7acd71505f790dfab81bcbe185fd88f98ca9869","observation_id":"ce9e398f-8114-404d-88c2-6813e20b1fa7","resolution":{"observed_at":"2026-08-15T23:08:00.606321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.641750Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":"5b011b68-c7e1-4b23-90b4-1d926210c5d6","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.611284Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:355c83a18a2c0bafdc735741b7db36229a1c0493162426268ccfd7f83d53bf6a","observation_id":"cb08a361-f53c-420d-8642-b9f9871e77c0","resolution":{"observed_at":"2026-08-15T23:08:01.647036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.626136Z","title":"Qwen3: Think deeper, act faster, 4 2025","venue":null,"work_id":"e7bb69af-92bb-46a9-8eea-a1f9fa25d4e7","year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.616203Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:d8218fbf96861b063122e3577bffb20ccb763708b3a3c377de34652bc4fe8356","observation_id":"64083c27-407d-4779-bfc2-bb9c0086eb43","resolution":{"observed_at":"2026-08-15T23:08:01.631083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.609791Z","title":"Foreign-language quotations and code-switching: The grammar behind","venue":null,"work_id":"2bf3a86a-040c-4c59-88a3-97df9fac2350","year":2004},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.621320Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:762210bc9e45d3d4fb418dfd6128b8d902e488aa54002c67f2f44031e2c2dd7f","observation_id":"613a44bb-b0e7-4883-a6c9-2d3d25919089","resolution":{"observed_at":"2026-08-15T23:08:01.614988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.594637Z","title":"The state and fate of linguistic diversity and inclusion in the NLP world","venue":null,"work_id":"89a78321-8fe2-42a4-8059-7cf1bfd15b07","year":2020},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.626236Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:a9b8a702203f30040a38102a4ed16dd1c4e95519f4755b28c8ad4ae113ea4e74","observation_id":"1518f66e-d0a6-4e5e-bb31-ffe224b518da","resolution":{"observed_at":"2026-08-15T23:08:01.599461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.578601Z","title":"Language model tokenizers introduce unfairness between languages","venue":null,"work_id":"82c43431-b379-43c2-8e1c-5a1e8a3bdad6","year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.630751Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:9c1321cd74424dfed576bdd64edab5cb7b6e65476b4d32a42e25a72cfa0d2f48","observation_id":"336c80b5-b12d-4e72-a5e9-3ad088fc9918","resolution":{"observed_at":"2026-08-15T23:08:01.584409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.563271Z","title":"Smith, and Yulia Tsvetkov","venue":null,"work_id":"0ba1277d-ba42-4fe8-896a-c80d898a5ac7","year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.635351Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:6c08e8953f82dd08d034f2bfed34a922cf60835e8bce6c8c7c52807a80f3bd6c","observation_id":"143eff3b-f4e6-4db1-85ce-e629ab29ad04","resolution":{"observed_at":"2026-08-15T23:08:01.568043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.547703Z","title":"Olympicarena: Benchmarking multi-discipline cognitive reasoning for superintelligent ai","venue":null,"work_id":"24f2eb7c-48a8-4cb4-98d7-e23b778c2027","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.639979Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:e881fdae33b02c7c88208eeec63fc37fa7581bf0155171e7951c0cfbe016c062","observation_id":"b1413cf4-9b8f-42f0-a60d-3fe98aa68ba8","resolution":{"observed_at":"2026-08-15T23:08:01.552753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21333","last_updated":"2025-06-13T19:10:02Z","snapshot_observed_at":"2026-08-16T13:05:35.873379Z","submitted_at":"2024-10-27T18:30:41Z","title":"Mind Your Step (by Step): Chain-of-Thought can Reduce Performance on Tasks where Thinking Makes Humans Worse","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21333","snapshot_observed_at":"2026-08-15T23:08:00.644773Z","title":"Mind your step (by step): Chain-of-thought can reduce performance on tasks where thinking makes humans worse","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.644773Z"},"links":{"cited_paper":"/paper/2410.21333","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:450e7e36407efc72dfed56ef9f522d59c3c2ac268a42dd9c7920f7d526aab7ff","observation_id":"5b530b99-ed81-41d9-b7d7-a6ec45dcb8d8","resolution":{"observed_at":"2026-08-15T23:08:00.644773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08235","last_updated":"2025-02-12T09:23:26Z","snapshot_observed_at":"2026-08-17T02:05:44.540631Z","submitted_at":"2025-02-12T09:23:26Z","title":"The Danger of Overthinking: Examining the Reasoning-Action Dilemma in Agentic Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08235","snapshot_observed_at":"2026-08-15T23:08:00.649709Z","title":"The danger of overthinking: Examining the reasoning-action dilemma in agentic tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.649709Z"},"links":{"cited_paper":"/paper/2502.08235","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:4a783d80adc17a242c20b0f75c4ad60ca7d067752ed6d10b8ba5303cd16cb9c7","observation_id":"ba977ab3-9ac9-4241-8d62-e1baf8f0fd33","resolution":{"observed_at":"2026-08-15T23:08:00.649709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-15T23:08:00.654610Z","title":"Do not think that much for 2+ 3=? on the overthinking of o1-like llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.654610Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:1708c5633ed0c0379c592bdbf2efc9c4a72458c2504ab9ec672c875cde4690f6","observation_id":"831a1e3b-f8df-4b89-bbd6-b030c4606009","resolution":{"observed_at":"2026-08-15T23:08:00.654610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-15T23:08:00.659695Z","title":"Stop overthinking: A survey on efficient reasoning for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.659695Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:f25d3f7e48739ea3d82af1bf870321a8e95742c69419197b6f83cafe04f6ae59","observation_id":"36d42f51-9370-4da3-bebe-97026403fde7","resolution":{"observed_at":"2026-08-15T23:08:00.659695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.532488Z","title":"BLOOM+1: Adding language support to BLOOM for zero-shot prompting","venue":null,"work_id":"088d705f-0909-41da-8384-ecd038470e95","year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.664573Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:684eb941530b9abf6519fc6a4ad7e882ec4d8e47a49441038f58606f30eabed1","observation_id":"c3906f4b-4903-487c-9188-902919c3c947","resolution":{"observed_at":"2026-08-15T23:08:01.537371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.517103Z","title":"Understanding catastrophic forgetting in language models via implicit inference","venue":null,"work_id":"28761b91-e662-4257-ba41-680c79cc16e4","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.669314Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:c3f724ae845b4b5beb598e7781ff25949bae87b0fb68409ed46479e39bb549d2","observation_id":"c868e812-d26b-41a8-bf33-267c891858ff","resolution":{"observed_at":"2026-08-15T23:08:01.521886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.501709Z","title":"Translating across cultures: LLMs for intralingual cultural adaptation","venue":null,"work_id":"ef63b91b-b27a-4467-b9ca-f64fe7d200c1","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.674024Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:66c96656167cca446b81a8374a88b7e19aaf713fe8927750d8422f5657ded147","observation_id":"d95a6dff-0406-43a5-8e27-8b24c5d4c9cd","resolution":{"observed_at":"2026-08-15T23:08:01.506553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16534","last_updated":"2025-08-30T14:48:20Z","snapshot_observed_at":"2026-08-16T12:55:58.825006Z","submitted_at":"2025-02-23T11:02:41Z","title":"Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16534","snapshot_observed_at":"2026-08-15T23:08:00.678858Z","title":"Multilingual!= multicultural: Evalu- ating gaps between multilingual capabilities and cultural alignment in llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.678858Z"},"links":{"cited_paper":"/paper/2502.16534","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:14056f737f1f1b9f46be27af4f08afeef936030a05851565a39f9b05578f5f55","observation_id":"c65ba839-b9c2-4c1b-b2ba-82e863274481","resolution":{"observed_at":"2026-08-15T23:08:00.678858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.485567Z","title":"Mortensen, and Graham Neubig","venue":null,"work_id":"d49eeace-bb67-49ae-8ee4-5c7de8fcf6d1","year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.683823Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:ed37f4fb869002d08990cc9a97b8c89ca620d89ac74117b58c55aadf6a8d33ac","observation_id":"863c91d6-4ca6-4aab-8506-6e7790aec02d","resolution":{"observed_at":"2026-08-15T23:08:01.490695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.469079Z","title":"Shortcomings of LLMs for low-resource translation: Retrieval and understanding are both the problem","venue":null,"work_id":"b2fbfad9-bc51-47d9-a946-be13ac73856d","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.688540Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:cf9396cb4bbd0ab96216d636695b0d49af455740a3077d93a19093c458f11ee6","observation_id":"b0524281-23f6-4547-b6a1-b75f5179fb92","resolution":{"observed_at":"2026-08-15T23:08:01.474661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24102","last_updated":"2025-08-22T15:58:31Z","snapshot_observed_at":"2026-08-16T16:11:33.112378Z","submitted_at":"2025-03-31T13:56:03Z","title":"Is Small Language Model the Silver Bullet to Low-Resource Languages Machine Translation?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24102","snapshot_observed_at":"2026-08-15T23:08:00.693181Z","title":"Is llm the silver bullet to low-resource languages machine translation? arXiv preprint arXiv:2503.24102, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.693181Z"},"links":{"cited_paper":"/paper/2503.24102","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:635afb12b9fc80839a375e175deab5d599e267cb88c5f8b1108f86492d6e2503","observation_id":"bddd0366-8877-452f-bad0-664f06acac78","resolution":{"observed_at":"2026-08-15T23:08:00.693181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.452310Z","title":"LLM-powered data augmen- tation for enhanced cross-lingual performance","venue":null,"work_id":"59980cc6-d277-4c54-bda1-817c42573f61","year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.697986Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:b0dc7a52a9f048b31abfd04840e701a02df08af40180e99141fe7be724430fda","observation_id":"af0e3dd4-c2b3-48ec-bc9c-4571819a52ea","resolution":{"observed_at":"2026-08-15T23:08:01.458061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.436039Z","title":"LexC-gen: Generating data for extremely low-resource languages with large language models and bilingual lexicons","venue":null,"work_id":"8f1d7a52-2f09-40c7-99d0-1ce75faa79c0","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.702497Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:81ce2c6b456e9c44dc8e14671b321bc7a64fc2d30a7016ac51f86ac66a10b23e","observation_id":"56ef7306-cc47-42f5-a8ab-083b159b8b0a","resolution":{"observed_at":"2026-08-15T23:08:01.440991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.419523Z","title":"XLM-V: Overcoming the vocabulary bottleneck in multilingual masked language models","venue":null,"work_id":"269d8819-21b7-41fb-9a6d-3ce75246d7b4","year":2023},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.707053Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:af6003bc5e77cb888ab5fe48b1a937f756c31c59a27daf36064f6b884d05f7d2","observation_id":"867c3e83-1c35-4898-afd1-7d378d25396e","resolution":{"observed_at":"2026-08-15T23:08:01.425549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.402915Z","title":"Adapters for altering LLM vocabularies: What languages benefit the most? In The Thirteenth International Conference on Learning Representations, 2025","venue":null,"work_id":"aa1da9a1-9bd9-4f53-b7df-84d9e26f7b12","year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.712021Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:6f1b2c9dd064967f6fb046846f568c32e456bf59cc4a08fb5a72d45bf8cdb775","observation_id":"2cd128f8-a3ca-4668-a5e5-1c9550de1247","resolution":{"observed_at":"2026-08-15T23:08:01.408281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.386097Z","title":"ByT5: Towards a token-free future with pre-trained byte-to-byte models","venue":null,"work_id":"2e0c9f05-c84b-41cd-9196-de4b2b5c1ebc","year":2022},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.716567Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:5f674495281a1ee59f7ade6f430a9d59e66aff0b425d4fb9d1f8cd719e189022","observation_id":"7adc6218-2a17-48dc-8834-b528ca8de777","resolution":{"observed_at":"2026-08-15T23:08:01.391304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.721221Z","title":"Small models struggle to learn from strong reasoners","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.721221Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:0296d21a98408b437d1579390b501483fa7b028da41ae329157fa3198d9524bd","observation_id":"9c0e533e-3d22-4e0e-b018-c527f898084a","resolution":{"observed_at":"2026-08-15T23:08:00.721221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14387","last_updated":"2025-06-10T12:04:44Z","snapshot_observed_at":"2026-08-16T13:08:04.351303Z","submitted_at":"2024-10-18T11:39:34Z","title":"How Do Multilingual Language Models Remember Facts?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14387","snapshot_observed_at":"2026-08-15T23:08:00.725796Z","title":"How do multilingual models remember? investigating multilingual factual recall mechanisms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.725796Z"},"links":{"cited_paper":"/paper/2410.14387","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:a47e3be72c151af71859ed3daa7deae96c5e5536328abdb6c0a634aa30f673db","observation_id":"6d5f2e68-e5cb-417b-8c00-608a8fa2ccea","resolution":{"observed_at":"2026-08-15T23:08:00.725796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:01.368399Z","title":"Sie isst 3 Eier zum Frühstück und verwendet 4 Eier für Muffins, also verwendet sie insgesamt 3 + 4 = 7 Eier pro Tag","venue":null,"work_id":"6d5e170c-c49a-4aaa-a26f-645ec0d4bd06","year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.731058Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:910e55a999882371b3c2ff00746242cb03cecc83a1ed1c0fcb0dc74039194cbc","observation_id":"10ada909-1c14-4ea0-a304-1acd3200b3a5","resolution":{"observed_at":"2026-08-15T23:08:01.375290Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:08:00.450740Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.450740Z"},"links":{"citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:083e01d64d7b665b5ee533e1335431264ff52b4452b2b69de240b67327e89651","observation_id":"d6de4d60-f612-40c2-b0cc-c3f8b41c2938","resolution":{"observed_at":"2026-08-15T23:08:00.450740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 8 inbound Pith citation observations for arXiv:2505.05408."}