{"as_of":"2026-08-09T18:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c8f5672036217d99870b9adaba225d2928158ab0b71e19adc2bca305d2dfdb59","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:25:16.984092Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:41.438347Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T02:19:23.876486Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-08-07T12:35:41.438347Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24782","last_updated":"2025-06-06T16:42:11Z","snapshot_observed_at":"2026-08-08T23:24:56.284825Z","submitted_at":"2025-05-30T16:43:28Z","title":"Context is Gold to find the Gold Passage: Evaluating and Training Contextual Document Embeddings","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.438347Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2505.24782"},"observation_digest":"sha256:91963d19f6b4843ff3999b694d94ff81a79ce4d9b03abb6df1b492d439c3739d","observation_id":"bfdbaa7f-bb57-45e9-a4bb-78d238f20d31","resolution":{"observed_at":"2026-08-07T12:35:41.438347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-08-05T15:51:32.176410Z","title":"Gsm-infinite: How do your llms behave over infinitely increasing context length and reasoning complexity? arXiv preprint arXiv:2502.05252 , 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19363","last_updated":"2025-08-26T18:41:53Z","snapshot_observed_at":"2026-08-05T15:51:17.708655Z","submitted_at":"2025-08-26T18:41:53Z","title":"LongReasonArena: A Long Reasoning Benchmark for Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T15:51:32.176410Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2508.19363"},"observation_digest":"sha256:597ddc6545cdeb3fd2c4dc270ee5e1a813a0e6d7da6a57e01082da9d05cf3b8f","observation_id":"2448123f-d8e5-4f46-ada2-a791e302adcd","resolution":{"observed_at":"2026-08-05T15:51:32.176410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-08-04T11:21:10.093674Z","title":"Gsm-infinite: How do your llms behave over infinitely increasing context length and reasoning complexity? arXiv preprint arXiv:2502.05252, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.05688","last_updated":"2026-05-25T12:53:13Z","snapshot_observed_at":"2026-08-04T11:21:03.843752Z","submitted_at":"2025-10-07T08:46:08Z","title":"vAttention: Verified Sparse Attention","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T11:21:10.093674Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2510.05688"},"observation_digest":"sha256:ef6800980d0757e7d6658ebf8f7fd92794ce842638afbe7e35e5ed6e582803e0","observation_id":"9c9a0ee7-7f47-4758-bf05-0b9669aa0dc6","resolution":{"observed_at":"2026-08-04T11:21:10.093674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":"2502.05252","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-07-04T02:19:23.876486Z","title":"Gsm- infinite: How do your llms behave over infinitely increas- ing context length and reasoning complexity?arXiv preprint arXiv:2502.05252","venue":null,"work_id":"d049069c-5784-4d64-bd0e-b2fdaf16cec4","year":2025},"citing_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-12T11:33:32.568261Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2601.02780"},"observation_digest":"sha256:be70def9661ee0ed387d0c63ae7fd8306c7f35f719627b3f19f8a817f97024b8","observation_id":"35219edd-3f3e-48a5-8495-413cc13ba9d3","resolution":{"observed_at":"2026-05-12T11:33:32.819008Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":"2502.05252","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-07-04T02:19:23.876486Z","title":"Gsm- infinite: How do your llms behave over infinitely increas- ing context length and reasoning complexity?arXiv preprint arXiv:2502.05252","venue":null,"work_id":"d049069c-5784-4d64-bd0e-b2fdaf16cec4","year":2025},"citing_paper":{"arxiv_id":"2601.21350","last_updated":"2026-05-16T02:45:10Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T07:18:45Z","title":"Factored Causal Representation Learning for Robust Reward Modeling in RLHF","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-21T14:18:33.768962Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2601.21350"},"observation_digest":"sha256:63da58137aec6276fef9e55ccb140817dc80beedd1b83b619dc809a26197fa42","observation_id":"513603ef-f1ea-4074-be2c-07e15eadb755","resolution":{"observed_at":"2026-05-21T14:20:13.602502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-07-15T15:10:27.013215Z","title":"GSM-Infinite: How do your LLMs behave over infinitely increasing context length and reasoning complexity?,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04560","last_updated":"2026-06-23T16:49:40Z","snapshot_observed_at":"2026-08-09T01:20:59.169906Z","submitted_at":"2026-03-04T19:44:55Z","title":"From Local Corrections to Generalized Skills: Improving Neuro-Symbolic Policies with MEMO","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-15T15:10:27.013215Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2603.04560"},"observation_digest":"sha256:2ed023ba4361d0606a1e6c48854c2b5dd4c072b219a88ac85a1e315527003c42","observation_id":"0ab7533e-c155-4bc4-91d7-dcefc186051d","resolution":{"observed_at":"2026-07-15T15:10:27.013215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":"2502.05252","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-07-04T02:19:23.876486Z","title":"Gsm- infinite: How do your llms behave over infinitely increas- ing context length and reasoning complexity?arXiv preprint arXiv:2502.05252","venue":null,"work_id":"d049069c-5784-4d64-bd0e-b2fdaf16cec4","year":2025},"citing_paper":{"arxiv_id":"2603.06870","last_updated":"2026-04-22T15:40:03Z","snapshot_observed_at":"2026-07-06T22:48:13.053749Z","submitted_at":"2026-03-06T20:42:41Z","title":"LEAD: Breaking the No-Recovery Bottleneck in Long-Horizon Reasoning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T14:34:14.413131Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2603.06870"},"observation_digest":"sha256:28e2e4734d265ff829774f40f69bb51cffccdeed8b554cea2e748430e9de85c4","observation_id":"c81149b1-e343-401f-9449-19308cc205c0","resolution":{"observed_at":"2026-05-15T14:35:55.740864Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":"2502.05252","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-07-04T02:19:23.876486Z","title":"Gsm- infinite: How do your llms behave over infinitely increas- ing context length and reasoning complexity?arXiv preprint arXiv:2502.05252","venue":null,"work_id":"d049069c-5784-4d64-bd0e-b2fdaf16cec4","year":2025},"citing_paper":{"arxiv_id":"2604.22951","last_updated":"2026-07-08T19:29:03Z","snapshot_observed_at":"2026-07-12T23:17:30.297545Z","submitted_at":"2026-04-24T18:49:08Z","title":"The Power of Power Law: Asymmetry Enables Compositional Reasoning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-08T11:49:49.787123Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2604.22951"},"observation_digest":"sha256:ef9338fec9d19fe37a4e743c09640ceffb021a567903d7cf874ae50e47487b77","observation_id":"74e4b96d-0ca5-4a0e-acd1-7008e2a33d6b","resolution":{"observed_at":"2026-05-11T19:31:08.190972Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-07-12T18:26:05.728364Z","title":"Gsm-infinite: How do your llms behave over infinitely increasing context length and reasoning complexity? arXiv preprint arXiv:2502.05252, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.22951","last_updated":"2026-07-08T19:29:03Z","snapshot_observed_at":"2026-07-12T23:17:30.297545Z","submitted_at":"2026-04-24T18:49:08Z","title":"The Power of Power Law: Asymmetry Enables Compositional Reasoning","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-07-12T18:26:05.728364Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2604.22951"},"observation_digest":"sha256:2794a686bb5f08ad50daa00efb9974c05c00a3e6131f76b07229b9d40a31cdd2","observation_id":"1d00e09b-b71d-4e6e-8d9b-49d4d7b10ae9","resolution":{"observed_at":"2026-07-12T18:26:05.728364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":"2502.05252","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-07-04T02:19:23.876486Z","title":"Gsm- infinite: How do your llms behave over infinitely increas- ing context length and reasoning complexity?arXiv preprint arXiv:2502.05252","venue":null,"work_id":"d049069c-5784-4d64-bd0e-b2fdaf16cec4","year":2025},"citing_paper":{"arxiv_id":"2605.20942","last_updated":"2026-05-20T09:28:06Z","snapshot_observed_at":"2026-08-02T08:48:03.833409Z","submitted_at":"2026-05-20T09:28:06Z","title":"Bridging Structure and Language: Graph-Based Visual Reasoning for Autonomous Road Understanding","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-21T05:25:20.511933Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2605.20942"},"observation_digest":"sha256:349656415880760572abd875014df7b8740dae3a21db03a066764e07e7400874","observation_id":"bb9b8bf6-909d-405b-aa7d-9a7e2cb7a8e6","resolution":{"observed_at":"2026-05-21T05:29:39.770407Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":"2502.05252","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-07-04T02:19:23.876486Z","title":"Gsm- infinite: How do your llms behave over infinitely increas- ing context length and reasoning complexity?arXiv preprint arXiv:2502.05252","venue":null,"work_id":"d049069c-5784-4d64-bd0e-b2fdaf16cec4","year":2025},"citing_paper":{"arxiv_id":"2605.28079","last_updated":"2026-05-27T07:33:47Z","snapshot_observed_at":"2026-08-07T09:29:14.165906Z","submitted_at":"2026-05-27T07:33:47Z","title":"ATLAS: All-round Testing of Long-context Abilities across Scales","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-29T13:30:09.778806Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2605.28079"},"observation_digest":"sha256:72ec87c52075bba40784cb5b39d3204323242ef6239997dfd8786957f9a544fc","observation_id":"6a15e411-70c4-41e4-aa92-dc30f06307ed","resolution":{"observed_at":"2026-06-29T13:33:27.979086Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":"2502.05252","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-07-04T02:19:23.876486Z","title":"Gsm- infinite: How do your llms behave over infinitely increas- ing context length and reasoning complexity?arXiv preprint arXiv:2502.05252","venue":null,"work_id":"d049069c-5784-4d64-bd0e-b2fdaf16cec4","year":2025},"citing_paper":{"arxiv_id":"2606.19613","last_updated":"2026-06-17T21:36:09Z","snapshot_observed_at":"2026-08-07T13:16:30.354063Z","submitted_at":"2026-06-17T21:36:09Z","title":"StaminaBench: Stress-Testing Coding Agents over 100 Interaction Turns","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-26T19:47:59.090249Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2606.19613"},"observation_digest":"sha256:0c900c4b8c225286754364d80c37f20bbd27081e7484069f3ce17b5afb0cae58","observation_id":"ff892fdb-d0b3-4522-8990-5e2477da3a48","resolution":{"observed_at":"2026-07-04T02:19:23.878014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-08-01T12:46:04.371774Z","title":"Gsm-infinite: How do your llms behave over infinitely increasing context length and reasoning complexity?arXiv preprint arXiv:2502.05252,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19345","last_updated":"2026-07-31T16:09:53Z","snapshot_observed_at":"2026-08-09T15:58:08.801086Z","submitted_at":"2026-07-21T17:59:21Z","title":"Copy Less, Ground More: Overcoming Repetitive Copying in Long-Context Reasoning via Evidence-Aware Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T12:46:04.371774Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2607.19345"},"observation_digest":"sha256:f9aa5f66579b55db9b6d9c919307bd13600ad6447113f4c7074fbe948b0710a1","observation_id":"09806160-cf7e-4d87-899c-67888cbaa6d6","resolution":{"observed_at":"2026-08-01T12:46:04.371774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05252","snapshot_observed_at":"2026-08-03T01:57:53.900522Z","title":"Gsm-infinite: How do your llms behave over infinitely increasing context length and reasoning complexity?arXiv preprint arXiv:2502.05252,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19345","last_updated":"2026-07-31T16:09:53Z","snapshot_observed_at":"2026-08-09T15:58:08.801086Z","submitted_at":"2026-07-21T17:59:21Z","title":"Copy Less, Ground More: Overcoming Repetitive Copying in Long-Context Reasoning via Evidence-Aware Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T01:57:53.900522Z"},"links":{"cited_paper":"/paper/2502.05252","citing_paper":"/paper/2607.19345"},"observation_digest":"sha256:3b4415978c297ba84c3e0bf6cbb63a35b5c9719cf1f3a40eb9654f21a388793c","observation_id":"3a8dba01-3ae5-4436-b557-10af259cd432","resolution":{"observed_at":"2026-08-03T01:57:53.900522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05252/citation-record","integrity":"/paper/2502.05252/integrity","json":"/paper/2502.05252/citation-record.json","paper":"/paper/2502.05252"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:25:16.740385Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.740385Z"},"links":{"citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:b0fce20546c3aea4ffac64df8bc8e1623bf4c1a260bf3f7ca79b0480b2a679f9","observation_id":"c4bb915a-8c43-4bb3-93a5-c825f3db962c","resolution":{"observed_at":"2026-08-08T20:25:16.740385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:25:16.747628Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.747628Z"},"links":{"citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:67b0760821dd1f212a1d09f7910e9e811527e6d669d11d41a486a795b63fdd1a","observation_id":"8ee7e233-7850-4e89-815c-7d80b9ef8b8d","resolution":{"observed_at":"2026-08-08T20:25:16.747628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16179","last_updated":"2024-12-18T17:36:36Z","snapshot_observed_at":"2026-07-06T19:37:11.636987Z","submitted_at":"2024-10-21T16:44:51Z","title":"MagicPIG: LSH Sampling for Efficient LLM Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16179","snapshot_observed_at":"2026-08-08T20:25:16.753303Z","title":"variables, where only implicit addition/subtraction can be generated. (d) contrasts (c) and shows an example that with additional ``three-entity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.753303Z"},"links":{"cited_paper":"/paper/2410.16179","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:4ec9fb0de5ffc5190e7efafb4dd99614766a2f33aaa5fe4047eb5de75372b6f2","observation_id":"23794d80-f9ca-4366-8a56-22813ae5adce","resolution":{"observed_at":"2026-08-08T20:25:16.753303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:25:16.761081Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.761081Z"},"links":{"citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:1c716af9e95d616a44fbbcc90c0b67b6744a547a5ce1a15fb1f9353f872b5883","observation_id":"767b9b18-8209-4b7e-b845-7ff8bba35e4a","resolution":{"observed_at":"2026-08-08T20:25:16.761081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-08T20:25:16.766880Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.766880Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:88b85fc33b94b04df4d9d0dffccd256ce2d55f143c97ab2fdcf3fbed01842708","observation_id":"70001e99-033b-4608-9428-9cf998ad5983","resolution":{"observed_at":"2026-08-08T20:25:16.766880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15204","last_updated":"2025-01-03T11:44:51Z","snapshot_observed_at":"2026-08-04T21:07:04.238345Z","submitted_at":"2024-12-19T18:59:17Z","title":"LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15204","snapshot_observed_at":"2026-08-08T20:25:16.772448Z","title":"Longbench v2: Towards deeper understanding and reasoning on realistic long-context multitasks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.772448Z"},"links":{"cited_paper":"/paper/2412.15204","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:3afaaf21d47b7e8b591e92afb4c2574b3f71180fb2b6d391f512432dc99d5ed3","observation_id":"e456d5dd-cf02-4266-848d-c477b5ed4276","resolution":{"observed_at":"2026-08-08T20:25:16.772448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-08T20:25:16.777759Z","title":"Peters, and Arman Cohan","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.777759Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:91602e0ac9714562b6ee9315f24ee3667a56de17e153ffbd58635b5032426a6f","observation_id":"37095ade-0bf5-4673-941a-15fc4536eb9f","resolution":{"observed_at":"2026-08-08T20:25:16.777759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-08T20:25:16.788920Z","title":"Le, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.788920Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:9ef86c29970dfacb7e54e65857dea8de3d1462fcacd9bddb5727ba378616800f","observation_id":"af607390-b8c6-49c2-94ef-527c11dcf5ae","resolution":{"observed_at":"2026-08-08T20:25:16.788920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T20:25:16.800528Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.800528Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:aae53d2a316169b46258bd449eea22a7feb39220c2e7011bdffde639a7b3ab96","observation_id":"2816ea9e-b8a9-4e7c-a8bb-2b4aed73cd54","resolution":{"observed_at":"2026-08-08T20:25:16.800528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:25:16.805549Z","title":"Flash A ttention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.805549Z"},"links":{"citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:89103cb7aa2e3ff54d13d12cd64fce55444009dffb93a7188a5c19eb3d840d31","observation_id":"deb7c6a1-35a5-4fd0-98f0-f325b302d22c","resolution":{"observed_at":"2026-08-08T20:25:16.805549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:25:17.677044Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher R \\'e","venue":null,"work_id":"ab5de59e-83b3-4851-800c-e4c7224a3dfa","year":2022},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.810585Z"},"links":{"citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:d84aafe2683e5e077a587108dfa7e06f3c9cd696263c93fb12a5a350d17c633e","observation_id":"f22df550-9487-4c3f-96d5-4cc61017e205","resolution":{"observed_at":"2026-08-08T20:25:17.682833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-08T20:25:16.815476Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.815476Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:ed97b2523dccc8284768e8ef1578717f36dce770346442cd60c01a8cccd139be","observation_id":"fd4ba3bb-527f-403a-9c2e-188f9529c300","resolution":{"observed_at":"2026-08-08T20:25:16.815476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-08T20:25:16.820859Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.820859Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:c9ed7151eda425c137f65bf28d1d751ff51a72e4c6b59ea800131219670c3a9c","observation_id":"cc7a17b9-e075-4884-95d5-0a71615f0d35","resolution":{"observed_at":"2026-08-08T20:25:16.820859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T20:25:16.826047Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.826047Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:154db7ad6bec77b2b30d3b7a73ce820c9ad1a2a4ac7b3c103588a68bf96fedd4","observation_id":"c2fa464d-b6be-449f-96e3-ecf758f6a627","resolution":{"observed_at":"2026-08-08T20:25:16.826047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:25:17.658422Z","title":"Needle in a haystack - pressure testing llms, 2023","venue":null,"work_id":"b169d1ba-d3c3-4e46-b823-d2b1c1bec593","year":2023},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.832004Z"},"links":{"citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:09b473aac83fc58cc9cc54e6ac6153b461d03917c3717862872be14ff16192d3","observation_id":"911d184e-580f-41f9-9fee-f9ec652b0794","resolution":{"observed_at":"2026-08-08T20:25:17.664012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-08T20:25:16.837781Z","title":"Measuring mathematical problem solving with the math dataset, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.837781Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:19867c5d1c291bb6152ed07f8cd7359ae4aaca42115ae1b76cb6b44665f1cffe","observation_id":"f57ef75e-9fff-47cb-91c9-5ab88eb228c1","resolution":{"observed_at":"2026-08-08T20:25:16.837781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-08T20:25:16.848492Z","title":"Ruler: What's the real context size of your long-context language models?, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.848492Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:f1748285da2c47cd0f81e4fc1aec2bcf8e6f874b6a8bab2631c88aae605b7005","observation_id":"2a8d70f9-c571-4ef6-9661-5c72e8cb49e8","resolution":{"observed_at":"2026-08-08T20:25:16.848492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-08T20:25:16.853620Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.853620Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:74c0e78106df1315489eed173cdc79ba547b3d9f73611edd669f35dd9eac9ac2","observation_id":"8b667d32-78fd-4e74-990b-52721a025d7e","resolution":{"observed_at":"2026-08-08T20:25:16.853620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06983","last_updated":"2023-10-22T00:11:13Z","snapshot_observed_at":"2026-07-06T15:26:06.998516Z","submitted_at":"2023-05-11T17:13:40Z","title":"Active Retrieval Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06983","snapshot_observed_at":"2026-08-08T20:25:16.859507Z","title":"Xu, Luyu Gao, Zhiqing Sun, Qian Liu, Jane Dwivedi-Yu, Yiming Yang, Jamie Callan, and Graham Neubig","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.859507Z"},"links":{"cited_paper":"/paper/2305.06983","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:635f771cabc71723b87eae8becd8e5df3ebf7076bae2e2a5b2522c685dcdf23c","observation_id":"5cb60de0-520f-42c2-91d2-faa9b7e76904","resolution":{"observed_at":"2026-08-08T20:25:16.859507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:25:17.640295Z","title":"Needle in a haystack - pressure testing llms, 2023","venue":null,"work_id":"0f6039f8-f231-4a72-a599-7cf0a437d74b","year":2023},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.864472Z"},"links":{"citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:9b7c6df7a106ce2982464c1e1258f834dfd96a75fb9eece913dffad1bdce1bd8","observation_id":"fa549915-4c4e-4630-b053-f062f4cad42d","resolution":{"observed_at":"2026-08-08T20:25:17.645657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-09T01:19:53.754048Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-08T20:25:16.869442Z","title":"Babilong: Testing the limits of llms with long context reasoning-in-a-haystack, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.869442Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:ffc808238fb27247ed64a8467361d9c4c95d439851f83cef933a2b7c14619ece","observation_id":"190ef306-8a5d-4f36-ba38-65563c3d4242","resolution":{"observed_at":"2026-08-08T20:25:16.869442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13121","last_updated":"2024-06-19T00:28:58Z","snapshot_observed_at":"2026-07-06T18:33:24.206083Z","submitted_at":"2024-06-19T00:28:58Z","title":"Can Long-Context Language Models Subsume Retrieval, RAG, SQL, and More?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13121","snapshot_observed_at":"2026-08-08T20:25:16.874664Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.874664Z"},"links":{"cited_paper":"/paper/2406.13121","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:7bfde1146a21c2fa5083eeb21637d214301cf5968be275c5b5b84960e780c270","observation_id":"eb849715-65bf-4fe6-9e3c-4df0bb4bb99e","resolution":{"observed_at":"2026-08-08T20:25:16.874664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14848","last_updated":"2024-07-10T17:01:37Z","snapshot_observed_at":"2026-08-06T06:21:41.245457Z","submitted_at":"2024-02-19T16:04:53Z","title":"Same Task, More Tokens: the Impact of Input Length on the Reasoning Performance of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14848","snapshot_observed_at":"2026-08-08T20:25:16.880139Z","title":"Same task, more tokens: the impact of input length on the reasoning performance of large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.880139Z"},"links":{"cited_paper":"/paper/2402.14848","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:3f6007a6af908337250177026b3879374769eb16f0f3e3e45fcde3988d0e7d71","observation_id":"d5b394f4-c6a7-4a30-8bc6-ee4cdde6c0cb","resolution":{"observed_at":"2026-08-08T20:25:16.880139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11401","last_updated":"2021-04-12T15:42:18Z","snapshot_observed_at":"2026-08-07T05:44:30.677502Z","submitted_at":"2020-05-22T21:34:34Z","title":"Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11401","snapshot_observed_at":"2026-08-08T20:25:16.885207Z","title":"Retrieval-augmented generation for knowledge-intensive nlp tasks, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.885207Z"},"links":{"cited_paper":"/paper/2005.11401","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:73420062855937d41f312472062d91b01d0434e9d4e280b08a515943ba28e270","observation_id":"2a7a3af3-51a2-46c5-bbf0-96150d6fcedc","resolution":{"observed_at":"2026-08-08T20:25:16.885207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01880","last_updated":"2024-12-27T14:34:37Z","snapshot_observed_at":"2026-07-06T20:16:13.411201Z","submitted_at":"2024-12-27T14:34:37Z","title":"Long Context vs. RAG for LLMs: An Evaluation and Revisits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01880","snapshot_observed_at":"2026-08-08T20:25:16.890221Z","title":"Long context vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.890221Z"},"links":{"cited_paper":"/paper/2501.01880","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:1d758225fd79dac12584d5cbe5deaf08cb8f8ce8a5e3b6232a2cacefcb64cac8","observation_id":"937d0ff0-3e26-4cde-aab8-2b32467d4ba9","resolution":{"observed_at":"2026-08-08T20:25:16.890221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:25:17.621307Z","title":"Retrieval augmented generation or long-context llms? a comprehensive study and hybrid approach","venue":null,"work_id":"20878f58-86ed-4e05-8669-0cdffa8ccba3","year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.895307Z"},"links":{"citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:cd0eccec466185e1823852d7705f8021c1c8bdc2effe9ce6420e87e59c3a87c2","observation_id":"2f5691aa-e510-4aca-a989-4e9e6de23538","resolution":{"observed_at":"2026-08-08T20:25:17.627462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-08-07T09:22:20.831075Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-08T20:25:16.900015Z","title":"Ring attention with blockwise transformers for near-infinite context, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.900015Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:973eedeac5b28f769bddd375ed07d52038cf514a8dcb5d5624e138019a3de35d","observation_id":"4520cab5-8190-40ec-9c3b-db670fd2140e","resolution":{"observed_at":"2026-08-08T20:25:16.900015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-08-08T20:25:16.905007Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.905007Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:1a14275863b76607f9e675b13c46e4c9c8d456abea5be2258800ac7a85c1ab77","observation_id":"1292359e-02cf-47e3-826f-2e24f6be073d","resolution":{"observed_at":"2026-08-08T20:25:16.905007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08467","last_updated":"2024-06-12T17:53:31Z","snapshot_observed_at":"2026-07-06T18:29:49.284504Z","submitted_at":"2024-06-12T17:53:31Z","title":"DafnyBench: A Benchmark for Formal Software Verification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08467","snapshot_observed_at":"2026-08-08T20:25:16.910497Z","title":"Dafnybench: A benchmark for formal software verification, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.910497Z"},"links":{"cited_paper":"/paper/2406.08467","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:40313c3c0422b5f9709fcb33465a4787e1cf43e5c01a4e69219ebddef755a409","observation_id":"da20d73c-593a-4b08-8a0b-38a07b2b10af","resolution":{"observed_at":"2026-08-08T20:25:16.910497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08313","last_updated":"2025-01-14T18:50:05Z","snapshot_observed_at":"2026-07-06T20:21:04.675084Z","submitted_at":"2025-01-14T18:50:05Z","title":"MiniMax-01: Scaling Foundation Models with Lightning Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08313","snapshot_observed_at":"2026-08-08T20:25:16.916090Z","title":"Minimax-01: Scaling foundation models with lightning attention, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.916090Z"},"links":{"cited_paper":"/paper/2501.08313","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:3e1cea2ca1d6a4a0561e55d7a0ef9a3a596fa283f6b03f97da34bb336dbfe7d1","observation_id":"e4214ef1-4b51-46d3-9c0c-f24b46781a31","resolution":{"observed_at":"2026-08-08T20:25:16.916090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-08T20:25:16.922469Z","title":"Gsm-symbolic: Understanding the limitations of mathematical reasoning in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.922469Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:cbbf2f0aff1dc064cbaa4f9fab6b6928ae4e3b56ce7acec6bdb113a0aabc7230","observation_id":"34d51ff1-5307-4ae5-b21c-113fca06d93d","resolution":{"observed_at":"2026-08-08T20:25:16.922469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-08T20:25:16.928032Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.928032Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:27e040d3f7f17bd06a4ec540ae9467da3b09909c6d36ec7b1eba56d5afe26f8e","observation_id":"9947327d-b5e3-4c06-8b34-13b21beb5bf3","resolution":{"observed_at":"2026-08-08T20:25:16.928032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04093","last_updated":"2025-02-09T16:06:53Z","snapshot_observed_at":"2026-08-06T20:00:26.901131Z","submitted_at":"2024-08-07T21:16:55Z","title":"Tree Attention: Topology-aware Decoding for Long-Context Attention on GPU clusters","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04093","snapshot_observed_at":"2026-08-08T20:25:16.933498Z","title":"Tree attention: Topology-aware decoding for long-context attention on gpu clusters, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.933498Z"},"links":{"cited_paper":"/paper/2408.04093","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:f25de7d8fa58fba553cf0178b7c23b9a48c1ec07a1a98b51a6bea3cdc8104c9d","observation_id":"516599cc-a18b-4080-ae52-665b23f30ef4","resolution":{"observed_at":"2026-08-08T20:25:16.933498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-08T20:25:16.939267Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.939267Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:dfe6d5c2441a16903839416ac0d1c8bcc0cb5d1f8c7fd08b02fef7dde8d359ba","observation_id":"208e2cbb-bcb8-44c1-bc73-2e1eead2fe66","resolution":{"observed_at":"2026-08-08T20:25:16.939267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-08T20:25:16.944984Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.944984Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:150ea15887bede974d71d6b3ee6ecf7594627add51abec9db2d9bd17c2f87f71","observation_id":"2f2b01ab-d196-479a-b1a9-a493a486b12d","resolution":{"observed_at":"2026-08-08T20:25:16.944984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12570","last_updated":"2024-08-22T17:38:59Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:38:59Z","title":"Jamba-1.5: Hybrid Transformer-Mamba Models at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12570","snapshot_observed_at":"2026-08-08T20:25:16.951317Z","title":"Jamba-1.5: Hybrid transformer-mamba models at scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.951317Z"},"links":{"cited_paper":"/paper/2408.12570","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:c55cebfdf43c5089802af3ffefa7c14f3672360f253bb9a88b5f47465ea82f7f","observation_id":"82a51e3a-6c9a-418c-8cad-62795881d5b4","resolution":{"observed_at":"2026-08-08T20:25:16.951317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:25:17.599073Z","title":"Modular elliptic curves and fermat's last theorem","venue":null,"work_id":"be91bcab-547c-45c6-a051-456004adabc6","year":1995},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.957513Z"},"links":{"citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:82ba489a17889f05355611d63f178a055a9d0f8c2a2d676ebdf73ba2c707b934","observation_id":"ee703469-e33e-4977-bfe5-8e082c6167ae","resolution":{"observed_at":"2026-08-08T20:25:17.607210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20311","last_updated":"2024-07-29T17:52:40Z","snapshot_observed_at":"2026-07-06T18:53:35.627045Z","submitted_at":"2024-07-29T17:52:40Z","title":"Physics of Language Models: Part 2.1, Grade-School Math and the Hidden Reasoning Process","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20311","snapshot_observed_at":"2026-08-08T20:25:16.962705Z","title":"Physics of language models: Part 2.1, grade-school math and the hidden reasoning process, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.962705Z"},"links":{"cited_paper":"/paper/2407.20311","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:fdcacaf9babef1f90d0f025ff17fa3dbdcba453ad2f6b0482af31a9a7f52cbdb","observation_id":"f8675a3e-e296-438c-86b1-91e4ee6e5ac3","resolution":{"observed_at":"2026-08-08T20:25:16.962705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16293","last_updated":"2024-08-29T06:49:20Z","snapshot_observed_at":"2026-08-04T04:22:16.650100Z","submitted_at":"2024-08-29T06:49:20Z","title":"Physics of Language Models: Part 2.2, How to Learn From Mistakes on Grade-School Math Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16293","snapshot_observed_at":"2026-08-08T20:25:16.968703Z","title":"Physics of language models: Part 2.2, how to learn from mistakes on grade-school math problems, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.968703Z"},"links":{"cited_paper":"/paper/2408.16293","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:00044a3aa6c6bf03c8d600166a304342b4c0ba6d5c71e18a10865e44a16fdf89","observation_id":"542152b1-4ed4-4c88-b19c-2b68971428c2","resolution":{"observed_at":"2026-08-08T20:25:16.968703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01666","last_updated":"2024-09-03T07:17:41Z","snapshot_observed_at":"2026-07-06T19:09:36.622509Z","submitted_at":"2024-09-03T07:17:41Z","title":"In Defense of RAG in the Era of Long-Context Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01666","snapshot_observed_at":"2026-08-08T20:25:16.979011Z","title":"In defense of rag in the era of long-context language models, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.979011Z"},"links":{"cited_paper":"/paper/2409.01666","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:d261b2853810c892574b92449d95b7bb5b6bb9efa9da33f98ad48e4aa523df56","observation_id":"87b9c447-6dd1-4c54-ac8d-e1a7496cf3d4","resolution":{"observed_at":"2026-08-08T20:25:16.979011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-08T20:25:16.984092Z","title":"bench: Extending long context evaluation beyond 100k tokens, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.984092Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:d4d81ad22c9ffb94043705fc970afd2108eddd3b2881a778988cccbb57a38ebb","observation_id":"c4e73476-9160-44b4-97d4-1b5ad729b0da","resolution":{"observed_at":"2026-08-08T20:25:16.984092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 14 inbound Pith citation observations for arXiv:2502.05252."}