{"as_of":"2026-08-10T05:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:262a131a5ae2ceeb2b101e9f9a98e534e2fa268af707fb9e1b5032a9ea0ed26e","coverage":[{"denominator":104,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:08:15.295893Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19959/citation-record","integrity":"/paper/2505.19959/integrity","json":"/paper/2505.19959/citation-record.json","paper":"/paper/2505.19959"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:05.030910Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:05.030910Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:b22043ea4702136c053deb18d27f2f4294c11bd20fabc2e5fb81086b0d65e843","observation_id":"36f009a4-20ce-4197-8907-d9602dbea4bc","resolution":{"observed_at":"2026-08-07T14:08:05.030910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11018","last_updated":"2024-10-17T17:45:09Z","snapshot_observed_at":"2026-07-06T18:01:18.745347Z","submitted_at":"2024-04-17T02:49:26Z","title":"Many-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11018","snapshot_observed_at":"2026-08-07T14:08:05.136655Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:05.136655Z"},"links":{"cited_paper":"/paper/2404.11018","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:5f6b2557cd528c5722de2a57c96aa6738946f938e338e4ec3db67b01d2291ff3","observation_id":"23c732eb-df23-457f-a0a0-5fa177053e3f","resolution":{"observed_at":"2026-08-07T14:08:05.136655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09752","last_updated":"2023-10-24T00:51:49Z","snapshot_observed_at":"2026-07-06T15:04:31.778399Z","submitted_at":"2023-03-17T03:28:17Z","title":"CoLT5: Faster Long-Range Transformers with Conditional Computation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09752","snapshot_observed_at":"2026-08-07T14:08:05.236860Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:05.236860Z"},"links":{"cited_paper":"/paper/2303.09752","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:a6fdc292c13e56995c4a22f98287be0ff9903feed979bdb27eb6600c069d84ae","observation_id":"be7399e1-51bd-41b4-8c07-2c21a5f53ef5","resolution":{"observed_at":"2026-08-07T14:08:05.236860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11088","last_updated":"2023-10-04T10:04:25Z","snapshot_observed_at":"2026-08-09T07:56:50.464493Z","submitted_at":"2023-07-20T17:59:41Z","title":"L-Eval: Instituting Standardized Evaluation for Long Context Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.11088","snapshot_observed_at":"2026-08-07T14:08:05.311060Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:05.311060Z"},"links":{"cited_paper":"/paper/2307.11088","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:21d8f8b01013197bd18d18230aa934b96892bf83cb88602a026de2107dd4c09d","observation_id":"c2baec95-7bfa-4e92-aac5-fcc38b2ae39b","resolution":{"observed_at":"2026-08-07T14:08:05.311060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:05.422287Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:05.422287Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:30bf899384977d18fad8df03c83246464b72423bed60aeaaf01025ed66e51204","observation_id":"57510041-f2d9-4931-8326-eefd7badf959","resolution":{"observed_at":"2026-08-07T14:08:05.422287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:05.547022Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:05.547022Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:e49a326c0bad261c5c10bedebe1fa2e9703574e09b6f06f999971ac8d3969adf","observation_id":"a77b48b4-e293-44d5-a58a-7b39933eb371","resolution":{"observed_at":"2026-08-07T14:08:05.547022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:05.631782Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:05.631782Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:6afe888fbdfe75d069433f5a976538df33cdc611ad6b35bc845a9fc7d5a03b06","observation_id":"8ad5788d-8e53-46f1-8c28-dd8014a251cf","resolution":{"observed_at":"2026-08-07T14:08:05.631782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:05.758842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:05.758842Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:9aa4c763b40f6e9ffd0c3f9ef9029aabd5f758da7650fde949fad49da3b16267","observation_id":"15d1f274-6d41-41b4-83ee-7d18abbe0fbf","resolution":{"observed_at":"2026-08-07T14:08:05.758842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:05.914253Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:05.914253Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:a79fa1c2c90365bd5186f5151efc12a22c509d19ac2deeb5e8e0d55cece87f82","observation_id":"50e0fadc-4431-4484-bc04-b0d3bed83d4b","resolution":{"observed_at":"2026-08-07T14:08:05.914253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15204","last_updated":"2025-01-03T11:44:51Z","snapshot_observed_at":"2026-08-04T21:07:04.238345Z","submitted_at":"2024-12-19T18:59:17Z","title":"LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15204","snapshot_observed_at":"2026-08-07T14:08:06.032342Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:06.032342Z"},"links":{"cited_paper":"/paper/2412.15204","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:a3dead65be5b60d395606e01a28128b306a60f05891e21d9dbdecdb5daec1e81","observation_id":"f8d27438-057f-41e9-b951-2da0fda1244f","resolution":{"observed_at":"2026-08-07T14:08:06.032342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07055","last_updated":"2024-08-13T17:46:12Z","snapshot_observed_at":"2026-07-06T19:00:17.992934Z","submitted_at":"2024-08-13T17:46:12Z","title":"LongWriter: Unleashing 10,000+ Word Generation from Long Context LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07055","snapshot_observed_at":"2026-08-07T14:08:06.170959Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:06.170959Z"},"links":{"cited_paper":"/paper/2408.07055","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:0a2f64df0501f2b8f042c803c9674dd86021d69866655903b2e0f540714e1a6d","observation_id":"a97493f8-f3ab-442b-aef1-73bcfab04b73","resolution":{"observed_at":"2026-08-07T14:08:06.170959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T14:08:06.251314Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:06.251314Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:91a03b2bbdd46227541ce2b4be48f66386f05491505482ffccd5787eacd68d45","observation_id":"da1b6433-0708-49d1-ac74-2f0e9a5d2d47","resolution":{"observed_at":"2026-08-07T14:08:06.251314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11612","last_updated":"2024-06-17T14:58:29Z","snapshot_observed_at":"2026-07-06T18:32:15.404516Z","submitted_at":"2024-06-17T14:58:29Z","title":"Long Code Arena: a Set of Benchmarks for Long-Context Code Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11612","snapshot_observed_at":"2026-08-07T14:08:06.406839Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:06.406839Z"},"links":{"cited_paper":"/paper/2406.11612","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:41dec7dab1e8faeb2ee4edfe4926206bdc059cbc8fb367859e5fd211fd2cbb4c","observation_id":"6c337982-4c99-441e-ad16-0052d5a4d5e5","resolution":{"observed_at":"2026-08-07T14:08:06.406839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:06.483335Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:06.483335Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:d3e2bebd7d9553b7681feb841ebbbd4ee16563aa503d3424d7122b5e5ff34aab","observation_id":"d480e881-d9dc-405a-bd8f-dcd5fcb33e43","resolution":{"observed_at":"2026-08-07T14:08:06.483335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:06.579957Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:06.579957Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:1f16e9e481d70c1b3f259a1dce0e1fcea24427bbc86e706fc444cc5033698cdd","observation_id":"ef648103-5316-44ca-ade2-f5e1d8d48d69","resolution":{"observed_at":"2026-08-07T14:08:06.579957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15595","last_updated":"2023-06-28T04:26:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-27T16:26:26Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15595","snapshot_observed_at":"2026-08-07T14:08:06.693696Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:06.693696Z"},"links":{"cited_paper":"/paper/2306.15595","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:e4fe613465a60268c0a6cab4f11c7e98d74d03cccef2a95aa55d862fcfd0cd7c","observation_id":"a21c9707-03d2-45e9-9ce7-ee8405ceb5d2","resolution":{"observed_at":"2026-08-07T14:08:06.693696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-09T19:46:04.857927Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-07T14:08:06.811278Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:06.811278Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:59ea1aa1d958646fad6600030fbe77ac60a6769f2cd61ea0ce0ebe8011ace9cd","observation_id":"f114dd67-bc14-47f4-9b9b-2efed519dbee","resolution":{"observed_at":"2026-08-07T14:08:06.811278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:06.950136Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:06.950136Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:5294f0493cc8d3882bc30db23eb0bc5bcd0121fc9e1acd3651058b49ff71b401","observation_id":"87bf290e-3bba-4cdd-915a-d99f0a966450","resolution":{"observed_at":"2026-08-07T14:08:06.950136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:07.053346Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:07.053346Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:e2457a615fe9c8ab88048a89d12c4d82fa2345edefde186df2865c57bbec7e77","observation_id":"30eab7a4-7492-4031-bed5-ef7c0eb7fe14","resolution":{"observed_at":"2026-08-07T14:08:07.053346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02486","last_updated":"2023-07-19T12:25:35Z","snapshot_observed_at":"2026-08-05T18:04:01.030198Z","submitted_at":"2023-07-05T17:59:38Z","title":"LongNet: Scaling Transformers to 1,000,000,000 Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02486","snapshot_observed_at":"2026-08-07T14:08:07.209849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:07.209849Z"},"links":{"cited_paper":"/paper/2307.02486","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:299ff3c17dbf4edb7f1c4eb24ba6c6d5e650fec5231a3d5fbf02275adab86a53","observation_id":"969928fe-81f9-49eb-b8bc-0c3df11bde47","resolution":{"observed_at":"2026-08-07T14:08:07.209849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:07.392559Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:07.392559Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:ba115ec1c7d9c07966a7c3e86cceb8c64935dc9ca7e422432bc63c0fc1a9a6a4","observation_id":"48bc94f3-5fca-44e4-a814-661f321d2550","resolution":{"observed_at":"2026-08-07T14:08:07.392559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:07.563125Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:07.563125Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:bc1531d01903afab6a154a863cfe54230d25ce7149b2cddded53d1123506ef46","observation_id":"ee3cac01-7388-4313-b766-a267c752b592","resolution":{"observed_at":"2026-08-07T14:08:07.563125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:08:07.748603Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:07.748603Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:9a7904af09b7be10f8a58061265566dd1a6601aacabb81f7ac2eaafc26d217d3","observation_id":"71ed5744-e0af-4a3c-89f1-84b3d0d16d90","resolution":{"observed_at":"2026-08-07T14:08:07.748603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:07.919917Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:07.919917Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:cbc62e13d24b448e96d634ab003cbf6b190a2fedcf618f4b5d3f69c9f8a815cc","observation_id":"3fc3a51a-5ee8-42c5-911f-2ed7f3fb8c3a","resolution":{"observed_at":"2026-08-07T14:08:07.919917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:07.977882Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:07.977882Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:ad898d0cdc9dce2d3d867a534992203aa94439326baf8e873abfbe1e4d0b643c","observation_id":"35fda01c-0384-43e1-9911-c5e4a41c165e","resolution":{"observed_at":"2026-08-07T14:08:07.977882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:08.055716Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.055716Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:c18e87c7cc8e9c0d542e87249ab45ec2c8d23ba65c7fc8660c8ac6053243a225","observation_id":"290cb31b-c8bf-4b7d-8540-cc10c75b5866","resolution":{"observed_at":"2026-08-07T14:08:08.055716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:08.151042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.151042Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:38ca0ac23606ca516f04779d92bef11ba4b73e8c1ceb143e007b60f17f70a60f","observation_id":"5d2e31bd-15cd-4e1c-92cc-f1a66cb79221","resolution":{"observed_at":"2026-08-07T14:08:08.151042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:08.209939Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.209939Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:40edf6cc5ada29ea4232335a430426c0070602cb06363e830200dca39664d809","observation_id":"228eb581-238d-4c91-8c31-b939e8cc29ae","resolution":{"observed_at":"2026-08-07T14:08:08.209939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-07T13:56:34.167869Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-07T14:08:08.324456Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.324456Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:6cdf3d4e3dae06eba32866c6a6b8d9023de6c692a2661694080dba8c6a25e4c6","observation_id":"1371f73f-d71c-40a7-9fde-f9f17b0a8472","resolution":{"observed_at":"2026-08-07T14:08:08.324456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:08.411868Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.411868Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:e7af3b1930c8c3d0074f3e03c33aff43ec81aa236ee0dc734e9438183aabe7e8","observation_id":"850e93ce-2b77-44cf-aa43-18b9cf0bf1ad","resolution":{"observed_at":"2026-08-07T14:08:08.411868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:08.503186Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.503186Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:04e21aef039a3c425fcf2502c235c18d3e4399d24156650bd49b3b79bc61cb21","observation_id":"d120db7c-28d0-462b-9768-f6dfac044ba0","resolution":{"observed_at":"2026-08-07T14:08:08.503186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:08.667419Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.667419Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:51da4bb5aefbba372480037244f84761c1b15f1263d28264320b8cf0da05007b","observation_id":"dd5cd532-6371-4231-ae3f-b43f55b1f4a8","resolution":{"observed_at":"2026-08-07T14:08:08.667419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:08.771896Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.771896Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:379bc1bc0c1bb039907d4fe24ac71ff4c70f162b10054e054bc43cc9c00a9b23","observation_id":"a93c96bf-87cf-4b59-bcac-06be6648e577","resolution":{"observed_at":"2026-08-07T14:08:08.771896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-07T14:08:08.874292Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.874292Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:2fdb69321f85d59cf0b5c7940f2f43b750a8313ca4d7bea585e3fc4d9f660241","observation_id":"3bbfd306-4f72-42d7-9f66-93a9ef997fe7","resolution":{"observed_at":"2026-08-07T14:08:08.874292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:08.993850Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:08.993850Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:46f20dd1df469c58898e25de1e5dba869162fa65612e35cdb046864221bcf75b","observation_id":"18ee87ac-c286-4071-a107-ecf4c743d4a1","resolution":{"observed_at":"2026-08-07T14:08:08.993850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.07858","last_updated":"2022-07-16T07:08:59Z","snapshot_observed_at":"2026-07-06T13:32:01.087734Z","submitted_at":"2022-07-16T07:08:59Z","title":"The Lottery Ticket Hypothesis for Self-attention in Convolutional Neural Network","version":1},"cited_work":{"arxiv_id":"2207.07858","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.07858","snapshot_observed_at":"2026-08-07T14:08:17.320763Z","title":"The Lottery Ticket Hypothesis for Self-attention in Convolutional Neural Network","venue":"cs.CV","work_id":"dd9709d7-aaed-4e55-9d70-bcc35db11730","year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.088736Z"},"links":{"cited_paper":"/paper/2207.07858","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:7e08eae58d7bc0cb5fa07245ac9280f322261ffe83d3ef84bf0b3894315b4adf","observation_id":"c0252c68-8494-4cdf-939c-61a954ea9b28","resolution":{"observed_at":"2026-08-07T14:08:17.423537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:09.188607Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.188607Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:cca946defd27c6ba7d352cfe593da345cfb2a43381b5a7bd386ce584d6d0eb1f","observation_id":"914562a3-c7ab-45f8-847b-cab42b0ce325","resolution":{"observed_at":"2026-08-07T14:08:09.188607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:09.291430Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.291430Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:b3980fa6cc5fb47738176802dcba093e39be12c02b960c02e553afa2e021d8d5","observation_id":"9ad75f55-6ae2-463c-be1d-9ddd0bd3bd08","resolution":{"observed_at":"2026-08-07T14:08:09.291430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02834","last_updated":"2024-06-23T08:45:33Z","snapshot_observed_at":"2026-08-07T23:10:12.222808Z","submitted_at":"2024-02-05T09:44:49Z","title":"Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02834","snapshot_observed_at":"2026-08-07T14:08:09.402382Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.402382Z"},"links":{"cited_paper":"/paper/2402.02834","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:6701b1808732f16355fb10ce50312021402db2aca742977e8dae010ec48dedd9","observation_id":"6556d149-7077-46c5-8a50-0d204d2d8db7","resolution":{"observed_at":"2026-08-07T14:08:09.402382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12844","last_updated":"2025-02-20T16:20:11Z","snapshot_observed_at":"2026-08-05T16:38:33.638599Z","submitted_at":"2024-07-04T17:57:38Z","title":"metabench -- A Sparse Benchmark of Reasoning and Knowledge in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12844","snapshot_observed_at":"2026-08-07T14:08:09.475795Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.475795Z"},"links":{"cited_paper":"/paper/2407.12844","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:ceb41de4dd37ea557bd78f14531cd24aa5fbf3cf4d18bb9e632885f665d6230a","observation_id":"bd35b406-d089-423a-ade4-f0b92e37ae66","resolution":{"observed_at":"2026-08-07T14:08:09.475795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:09.589789Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.589789Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:c9205823b1660b14c837ae4bb4bfc066e52f02f476effe7d5a0a31a338c4f7e6","observation_id":"911bf4f1-4f37-422b-9add-79148f797967","resolution":{"observed_at":"2026-08-07T14:08:09.589789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:09.675627Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.675627Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:1971d141ba261953c8262903a8010d72b40743f91aa8539c3e73e3b746707baa","observation_id":"11090f03-d740-49d1-81f1-c182a6ebdf46","resolution":{"observed_at":"2026-08-07T14:08:09.675627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12941","last_updated":"2025-01-24T19:23:15Z","snapshot_observed_at":"2026-08-05T01:31:35.222989Z","submitted_at":"2024-09-19T17:52:07Z","title":"Fact, Fetch, and Reason: A Unified Evaluation of Retrieval-Augmented Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12941","snapshot_observed_at":"2026-08-07T14:08:09.772386Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.772386Z"},"links":{"cited_paper":"/paper/2409.12941","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:ffe5538c3116e14bf67c5b6307147ae0c53ad4dc7bb59f79d89f438920b4f8db","observation_id":"331578aa-4376-4345-9ac5-68ab5bb9eb12","resolution":{"observed_at":"2026-08-07T14:08:09.772386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10149","last_updated":"2024-11-06T14:50:40Z","snapshot_observed_at":"2026-08-09T01:19:53.754048Z","submitted_at":"2024-06-14T16:00:29Z","title":"BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10149","snapshot_observed_at":"2026-08-07T14:08:09.869247Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.869247Z"},"links":{"cited_paper":"/paper/2406.10149","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:7cbbdbb818ebdcd94b4e3f189e9b26635c5cf19be74ffd436710cde0a1d8f1f0","observation_id":"54cc1b36-120f-4524-a2db-2901e5781a05","resolution":{"observed_at":"2026-08-07T14:08:09.869247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:09.987230Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:09.987230Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:523323ab57af3953d9b3b0e05030c587c3bb581814c46a0c55d1d5ad758e0de6","observation_id":"d7d61f63-e1c4-4a1c-90cf-e3d62cc8d642","resolution":{"observed_at":"2026-08-07T14:08:09.987230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:10.067995Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.067995Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:f0f7ea88c1c0ad3e4a906d7ab4ef2b9be31e4ab9eb5706155feae6fb1500f277","observation_id":"1df3c3c2-46c9-4818-88cd-40eaf7374158","resolution":{"observed_at":"2026-08-07T14:08:10.067995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:10.178485Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.178485Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:330f79dcfeeecadc25ee5c205a1022df1b6ca8fae46ee83eb8114604f356919a","observation_id":"fe12a0cf-eee7-4c20-9f4f-1df80de5642f","resolution":{"observed_at":"2026-08-07T14:08:10.178485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:22.643683Z","title":"Gonzalez, Ion Stoica, Xuezhe Ma, and Hao Zhang","venue":null,"work_id":"2e5449ad-3a58-4379-8f9a-563d177c3c53","year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.263096Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:52d1e980791ff637a826c83be8d3ebd5da9526fd6e0e2ea70ff45728467f7670","observation_id":"b3767e00-56b7-4996-8b68-1c6bc3ed3450","resolution":{"observed_at":"2026-08-07T14:08:22.753146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04939","last_updated":"2024-09-06T05:06:51Z","snapshot_observed_at":"2026-08-08T11:14:21.904860Z","submitted_at":"2023-11-08T01:45:37Z","title":"LooGLE: Can Long-Context Language Models Understand Long Contexts?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04939","snapshot_observed_at":"2026-08-07T14:08:10.341641Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.341641Z"},"links":{"cited_paper":"/paper/2311.04939","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:de4a0a719eb423a3f89eec5198d55b24b924285f0392ff76456129c5f39fd12a","observation_id":"c563a4cc-dee0-4af1-a8ad-1ab6b3cadab3","resolution":{"observed_at":"2026-08-07T14:08:10.341641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:10.457924Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.457924Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:fe5023895bd85b04931c8013a6eefb089317d8937104e662a3cd263e67b8cdfe","observation_id":"590d1170-c01e-4af8-b63f-1409c92f6ab2","resolution":{"observed_at":"2026-08-07T14:08:10.457924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:22.410282Z","title":null,"venue":null,"work_id":"d71b4b20-4358-4eb3-9595-57b0fbb8715e","year":2020},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.527332Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:5a3fe02a850ea1064a00e02a1ad5ac057726262a599b57447ed2130d21f16170","observation_id":"713bb8db-7235-4b2d-b246-e24730378138","resolution":{"observed_at":"2026-08-07T14:08:22.489352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13343","last_updated":"2025-03-18T02:16:56Z","snapshot_observed_at":"2026-08-01T15:59:14.413948Z","submitted_at":"2023-04-26T07:25:31Z","title":"SCM: Enhancing Large Language Model with Self-Controlled Memory Framework","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13343","snapshot_observed_at":"2026-08-07T14:08:10.635750Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.635750Z"},"links":{"cited_paper":"/paper/2304.13343","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:6652cd0da8ae44bd391793ef9f8ce99141fccdb0899390df6edb2aaa7398e097","observation_id":"c6c3adf7-ece6-4e28-9505-baf7c31fdd2b","resolution":{"observed_at":"2026-08-07T14:08:10.635750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:22.218098Z","title":null,"venue":null,"work_id":"638617fb-eddc-4d42-9bf9-2a97b2b33a71","year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.773877Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:297ec56729c96fae6299fd380f7b638a189a04d80929cbd25f5cfa2864047df6","observation_id":"bd8e2a89-9280-4813-9505-72fee745fe3f","resolution":{"observed_at":"2026-08-07T14:08:22.270695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03091","last_updated":"2023-10-04T01:13:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-05T17:59:41Z","title":"RepoBench: Benchmarking Repository-Level Code Auto-Completion Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03091","snapshot_observed_at":"2026-08-07T14:08:10.859817Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.859817Z"},"links":{"cited_paper":"/paper/2306.03091","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:d34eb00abb1372992f9ac1089bcb710726f131065c67b0c24b08a036c19e67d9","observation_id":"ffb61a20-d502-4cc3-b553-175d347860e5","resolution":{"observed_at":"2026-08-07T14:08:10.859817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:22.027430Z","title":null,"venue":null,"work_id":"50b6ce3e-3e72-4244-9e2c-a78830d82509","year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.962003Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:c7c0e8b681d26abb9eccceb32328b036eacfa11f707e5d4cc84559616d15a12a","observation_id":"975fa213-e651-4bc7-b6d8-794521052eeb","resolution":{"observed_at":"2026-08-07T14:08:22.107262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:21.812511Z","title":null,"venue":null,"work_id":"0ae936ef-a6b1-434f-8c83-63535afc8243","year":2019},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.066520Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:3e2668e588ac35a07c50644bd6dd8ad6df5dc5977f3afabcaf56c9f2f69242f9","observation_id":"659b3a56-e17f-4311-927b-5ac91875216d","resolution":{"observed_at":"2026-08-07T14:08:21.911882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:11.164535Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.164535Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:096e39012b28093d95769be0538157cf0c488980f9453d29264baf1e5eb46bc7","observation_id":"d863895b-7ab1-4774-b2ab-5dfff1cce93c","resolution":{"observed_at":"2026-08-07T14:08:11.164535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:11.263738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.263738Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:37f182fd9c2f4864a909e9500be63c9c88f13eabeae0ab00b27232cbc303dd3e","observation_id":"eb788b76-9f08-4ba5-9f02-2c97a112fcf8","resolution":{"observed_at":"2026-08-07T14:08:11.263738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:21.566672Z","title":null,"venue":null,"work_id":"ec84d619-50bc-45cc-a0f4-97d9487096e7","year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.366868Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:8d2884b1ff459612e7b26310c986b7f06553822f22a5ba168f3b2d7eaded9bab","observation_id":"c1995f35-4992-40ef-822b-5f93b1301f17","resolution":{"observed_at":"2026-08-07T14:08:21.648741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06349","last_updated":"2023-03-11T08:53:11Z","snapshot_observed_at":"2026-08-07T23:56:00.613985Z","submitted_at":"2023-03-11T08:53:11Z","title":"Resurrecting Recurrent Neural Networks for Long Sequences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06349","snapshot_observed_at":"2026-08-07T14:08:11.477758Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.477758Z"},"links":{"cited_paper":"/paper/2303.06349","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:3cbb9335d4f8f0ce6dc25bb140f3e33d5534216f432382d3a665063bb0a4b4ac","observation_id":"caab8c05-60db-45b6-96f1-b1f50c6e58b0","resolution":{"observed_at":"2026-08-07T14:08:11.477758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03563","last_updated":"2024-09-05T14:19:45Z","snapshot_observed_at":"2026-08-09T07:59:30.785256Z","submitted_at":"2024-09-05T14:19:45Z","title":"100 instances is all you need: predicting the success of a new LLM on unseen data by testing on a few instances","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03563","snapshot_observed_at":"2026-08-07T14:08:11.562127Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.562127Z"},"links":{"cited_paper":"/paper/2409.03563","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:0f471c9c42dafb159f1bdc40a90485e4171cf65280b2ee2385ba42e247a4f31b","observation_id":"9a27f10b-e3da-4e11-8b1f-2892246834e9","resolution":{"observed_at":"2026-08-07T14:08:11.562127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:21.365209Z","title":null,"venue":null,"work_id":"633b031e-be37-4e36-bb06-c9bd96e3d54b","year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.671826Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:9a4e2e5e69f8ac4e22d751edaf8833ed31873f1468bf0715d1de875c7b8d8c85","observation_id":"969dc72c-4365-49a3-b14e-2f720a7bf920","resolution":{"observed_at":"2026-08-07T14:08:21.453040Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:21.202648Z","title":null,"venue":null,"work_id":"18e29e33-9de6-47a3-b3b8-9a284e4152f2","year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.758897Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:563ab769fb785144fe5c16975d1ad55cbef9b7b52ab1d0694f01aa0b33edfa60","observation_id":"b3755203-6e5a-4b64-8275-f03103895d99","resolution":{"observed_at":"2026-08-07T14:08:21.272801Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:11.873071Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.873071Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:b2deb3c5082469dc9c3fb0be43f08471b542188efcd50d7d2479430ed947f3ca","observation_id":"fa28b1c8-1a01-4999-9b0c-182ebfd681f9","resolution":{"observed_at":"2026-08-07T14:08:11.873071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16191","last_updated":"2024-09-24T15:38:11Z","snapshot_observed_at":"2026-08-03T19:24:54.460507Z","submitted_at":"2024-09-24T15:38:11Z","title":"HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16191","snapshot_observed_at":"2026-08-07T14:08:11.951710Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:11.951710Z"},"links":{"cited_paper":"/paper/2409.16191","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:887a8a4df9d233307e879e04a517c9a903c11a3c760191d911b23c651ee64e0d","observation_id":"87ee0065-c944-4130-8978-cd0b559da56b","resolution":{"observed_at":"2026-08-07T14:08:11.951710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:12.059470Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.059470Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:fc1fe20321d87daeeb03b7507eec0818940d33f7ae440a8980f7fdd0eb7e9e12","observation_id":"d256a96e-bfba-418d-93af-3e13acaa1efa","resolution":{"observed_at":"2026-08-07T14:08:12.059470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T14:08:12.159404Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.159404Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:51a5cf98e4babebb465f51e5c632dd21c833d758a2781d16afe5397ed2a494b2","observation_id":"fa8ad007-d480-4cb0-ae77-afc02aae811a","resolution":{"observed_at":"2026-08-07T14:08:12.159404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:12.268435Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.268435Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:ac202312ecefe4d29081c2a616603b124d5cffc5a5fe365a326f951fa870df19","observation_id":"1165895d-a84c-4ea6-b074-b71bd1f189f3","resolution":{"observed_at":"2026-08-07T14:08:12.268435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04272","last_updated":"2023-09-26T04:43:31Z","snapshot_observed_at":"2026-08-09T15:29:22.777499Z","submitted_at":"2023-01-11T02:25:10Z","title":"Data Distillation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04272","snapshot_observed_at":"2026-08-07T14:08:12.368424Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.368424Z"},"links":{"cited_paper":"/paper/2301.04272","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:3a242609681a280700043094718a0502b3226c818cacb6c487cc2a160c85b1ac","observation_id":"8eac7892-6b1c-44d1-86da-d5d1554946a3","resolution":{"observed_at":"2026-08-07T14:08:12.368424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14196","last_updated":"2023-12-17T17:05:09Z","snapshot_observed_at":"2026-08-03T17:17:47.899275Z","submitted_at":"2023-05-23T16:15:31Z","title":"ZeroSCROLLS: A Zero-Shot Benchmark for Long Text Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14196","snapshot_observed_at":"2026-08-07T14:08:12.475103Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.475103Z"},"links":{"cited_paper":"/paper/2305.14196","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:69c0a0f25df9045bffe52437ed25fadd03bba6490910dba97b8a5230c0114ebd","observation_id":"0dc304fa-0f89-40e6-8639-7fcad892a0ca","resolution":{"observed_at":"2026-08-07T14:08:12.475103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:12.587074Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.587074Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:a983d329d75a453e85f38d1c71f2f6b9a4dd2db8c9788bb59f4329bebfe585ce","observation_id":"c079bdd4-900f-4443-a405-df9200804bb8","resolution":{"observed_at":"2026-08-07T14:08:12.587074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11802","last_updated":"2024-12-24T01:41:28Z","snapshot_observed_at":"2026-08-10T01:47:41.207025Z","submitted_at":"2024-03-18T14:01:45Z","title":"Counting-Stars: A Multi-evidence, Position-aware, and Scalable Benchmark for Evaluating Long-Context Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11802","snapshot_observed_at":"2026-08-07T14:08:12.726053Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.726053Z"},"links":{"cited_paper":"/paper/2403.11802","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:24357536e7a59c65fa195f78e5ed6408ff34540901dd69df68af468c903881a3","observation_id":"9ccd3baa-49a3-4c3f-aabd-9f5bb6097bfc","resolution":{"observed_at":"2026-08-07T14:08:12.726053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:12.802069Z","title":null,"venue":null,"work_id":null,"year":1961},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.802069Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:924426fe4acb7c0f8d7ca6171c7eebc00cec656823c5269c99eeeb4976d9b6fa","observation_id":"ed4a417c-0849-49bf-b923-b2c7fdfd3bb8","resolution":{"observed_at":"2026-08-07T14:08:12.802069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10554","last_updated":"2022-12-20T18:56:20Z","snapshot_observed_at":"2026-08-09T00:51:36.452647Z","submitted_at":"2022-12-20T18:56:20Z","title":"A Length-Extrapolatable Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10554","snapshot_observed_at":"2026-08-07T14:08:12.883259Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.883259Z"},"links":{"cited_paper":"/paper/2212.10554","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:b22f1a3d36f67fcbde9b8c2f4e9642cdf721f0359594223bae71869867dba916","observation_id":"613f2a18-8206-4807-8b1f-bcc3779a936f","resolution":{"observed_at":"2026-08-07T14:08:12.883259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:12.956018Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:12.956018Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:034d8b69a17eeaa2c03d2469cfc3b705449ba9b9c62b484f0d4bbd82dfa27cc5","observation_id":"f4d2d20d-9037-4145-acfa-88d1d4f1784c","resolution":{"observed_at":"2026-08-07T14:08:12.956018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:20.756573Z","title":null,"venue":null,"work_id":"83405447-3a79-48af-91cb-ebadd558f3fe","year":2021},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.052388Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:ae1d5d6a092fbc42d967e77cb550690c6893e7923c1dec890acc8e98610ffa1c","observation_id":"76d8bcea-53d0-4f88-befa-c629a28f5fe6","resolution":{"observed_at":"2026-08-07T14:08:20.887675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:13.148130Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.148130Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:a17e963b358f99e046890150a1a097fdcb578ad2e8d234f9a075bf9b89992885","observation_id":"b6092f5c-4adb-4a28-b4fa-9857e8a9b1cc","resolution":{"observed_at":"2026-08-07T14:08:13.148130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:13.223968Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.223968Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:2be7c90e1ffbd84275421dcc9a195855f51bf6b1f352e3f39bd742e3ebfbb296","observation_id":"ea2f2ad2-1e87-43fc-8744-ef7668cff118","resolution":{"observed_at":"2026-08-07T14:08:13.223968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12640","last_updated":"2024-09-20T00:47:33Z","snapshot_observed_at":"2026-07-06T19:18:04.618039Z","submitted_at":"2024-09-19T10:38:01Z","title":"Michelangelo: Long Context Evaluations Beyond Haystacks via Latent Structure Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12640","snapshot_observed_at":"2026-08-07T14:08:13.293848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.293848Z"},"links":{"cited_paper":"/paper/2409.12640","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:56bbf200c1166145da271acc73631c87bd3fde3ad12c35cfb1ae84e16a5b64f9","observation_id":"053e82e7-0cc7-4800-afee-e20eb51302f8","resolution":{"observed_at":"2026-08-07T14:08:13.293848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:20.514294Z","title":null,"venue":null,"work_id":"06c7cc4e-2c77-4f21-9b36-74803ffa144c","year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.395062Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:007dc583a4aaafbc92a0d9c6b4a792c376ab25565d2c6231034a7e6e37e84381","observation_id":"cdda6206-0c00-4e11-8cc3-e73651ab7dcf","resolution":{"observed_at":"2026-08-07T14:08:20.572057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:20.387967Z","title":null,"venue":null,"work_id":"9264027d-e866-4e8f-8472-b21c40e4bd80","year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.528436Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:e0587aa0e675e3a9d331b0327ef905ef170f1feaf0d7a6d6c460843f7fe2fc18","observation_id":"13713aa4-6407-45e6-98bc-a76cd77816c0","resolution":{"observed_at":"2026-08-07T14:08:20.446913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-07T14:08:13.613513Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.613513Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:7ce29f4c576547a78e4ceedd68426e93fb925cec98651b55ae1151a8d548b381","observation_id":"978c295b-9eda-4a7b-becb-fcc701d835e6","resolution":{"observed_at":"2026-08-07T14:08:13.613513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02076","last_updated":"2025-01-23T00:52:08Z","snapshot_observed_at":"2026-08-09T15:51:57.712199Z","submitted_at":"2024-09-03T17:25:54Z","title":"LongGenBench: Benchmarking Long-Form Generation in Long Context LLMs","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02076","snapshot_observed_at":"2026-08-07T14:08:13.719847Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.719847Z"},"links":{"cited_paper":"/paper/2409.02076","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:72ea4e9ac3e5cc11ed83d22e66c4b9909c6067927343e802ed74b4e99c39f7b6","observation_id":"f084daa4-80b3-4738-be30-c30b2fe271c1","resolution":{"observed_at":"2026-08-07T14:08:13.719847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:13.808547Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.808547Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:a56382b403bfe252823a89b8a8c100ddaf8dcdc01d9ba53ca182ef8dfc588f18","observation_id":"3d31721f-a409-4053-b2e7-3e9d34cf48d4","resolution":{"observed_at":"2026-08-07T14:08:13.808547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:20.221456Z","title":null,"venue":null,"work_id":"017002fe-fda9-4ba2-8291-8830015430d6","year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.883028Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:8a5a3de86414b85d48d6aeefaed7afa262f387581c43fcfb03bf175ada4d4619","observation_id":"b26290f0-e434-4f2d-acf4-8ea8706ac880","resolution":{"observed_at":"2026-08-07T14:08:20.274164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:20.085202Z","title":null,"venue":null,"work_id":"0d58f78d-b953-4b2b-8bb0-f5fdda965bee","year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:13.960049Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:f5d4b169cc6d2e13e3e47553981b4d4e9af7f1b7e5447f6633c4554d94a4d076","observation_id":"020da7cb-4fad-45c7-937a-e813364e8d57","resolution":{"observed_at":"2026-08-07T14:08:20.146089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11187","last_updated":"2024-10-15T01:58:58Z","snapshot_observed_at":"2026-08-02T23:45:33.761426Z","submitted_at":"2024-02-17T04:16:30Z","title":"LaCo: Large Language Model Pruning via Layer Collapse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11187","snapshot_observed_at":"2026-08-07T14:08:14.032835Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.032835Z"},"links":{"cited_paper":"/paper/2402.11187","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:0f575411f7cbb956deccafed6276060dd7c72b1ed2e60eeb7d8579fa4d453fbc","observation_id":"4a039955-dfb5-49d8-adb2-f6367fb18e70","resolution":{"observed_at":"2026-08-07T14:08:14.032835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:14.143534Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.143534Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:7d7f6f2ea2ef4cbcc8340c41d4bc05ccd8c8b60a8d57b058de06ab46228ce5d3","observation_id":"45e51e4a-1647-4678-8a1b-94cbc619a263","resolution":{"observed_at":"2026-08-07T14:08:14.143534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02694","last_updated":"2025-03-06T18:41:54Z","snapshot_observed_at":"2026-08-06T10:41:12.245173Z","submitted_at":"2024-10-03T17:20:11Z","title":"HELMET: How to Evaluate Long-Context Language Models Effectively and Thoroughly","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02694","snapshot_observed_at":"2026-08-07T14:08:14.241741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.241741Z"},"links":{"cited_paper":"/paper/2410.02694","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:68be7392dde5a35a4076e3974ec4c4ee80d2b663d87bdc4f35d6d82e1b9194aa","observation_id":"27e9d54c-f2ab-49f2-9bfe-d1246d76f661","resolution":{"observed_at":"2026-08-07T14:08:14.241741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:19.880081Z","title":null,"venue":null,"work_id":"83760980-7c63-43f3-829b-519021f3856e","year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.344622Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:c21773a562f1441cbf0eba7306155dfde54f204a72ad7043c194edc131306e2d","observation_id":"dc2e0918-8420-4d97-a763-0657d119a533","resolution":{"observed_at":"2026-08-07T14:08:19.931372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:14.438299Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.438299Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:e795c24595df9379079934482958ea16f9ec8ffcf31b093875b7acd0948fa59d","observation_id":"0ae1b696-6ad6-4084-bd2c-ade7194d028f","resolution":{"observed_at":"2026-08-07T14:08:14.438299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:14.538802Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.538802Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:eb445e51e7173719cef784d5b88f4d20bfb59333bcff3ab3743e6dd5422b91d4","observation_id":"99d0467f-c0f3-4048-8fab-2207ed4bae3a","resolution":{"observed_at":"2026-08-07T14:08:14.538802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02897","last_updated":"2024-09-10T07:43:19Z","snapshot_observed_at":"2026-07-06T19:10:29.880696Z","submitted_at":"2024-09-04T17:41:19Z","title":"LongCite: Enabling LLMs to Generate Fine-grained Citations in Long-context QA","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02897","snapshot_observed_at":"2026-08-07T14:08:14.621446Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.621446Z"},"links":{"cited_paper":"/paper/2409.02897","citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:a35ae6ccbc791a00b3603ffca098f788307eb112543a94c180081646f7a27895","observation_id":"21837170-dad2-4678-a1ed-726b05d60ae2","resolution":{"observed_at":"2026-08-07T14:08:14.621446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:14.728257Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.728257Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:25312631c24a95915d762b4e980e0f060a094dd26a38659ea30053e6664cc8b2","observation_id":"0f0d6dee-93dd-40dd-be67-08aa5684ffc0","resolution":{"observed_at":"2026-08-07T14:08:14.728257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:14.797283Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.797283Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:5b4fc9c7ef13c915dc6c3c4c27f04639d744fa351edd984df4b985d697ed6947","observation_id":"12101dee-2e4c-4a83-a7a1-c593944293ed","resolution":{"observed_at":"2026-08-07T14:08:14.797283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:19.582651Z","title":null,"venue":null,"work_id":"8452e7a4-c4d0-431e-ab7b-d191db1a12b6","year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:14.886811Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:075e558ff134bd2df3b9bd28a92c1b9e8984f430b9f012c11f04f25a755036f8","observation_id":"2a3f47dc-e8a8-4940-8793-ba35e51c9adb","resolution":{"observed_at":"2026-08-07T14:08:19.651989Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:19.365373Z","title":null,"venue":null,"work_id":"2e08db2f-88f3-434a-b087-7c13f431e971","year":2024},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:15.012338Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:67e9fa21ffd3c7c69e2267c081aa38a0216200f8d6ed6a478f729c69a447e421","observation_id":"4b0cde7d-d13a-4a9a-b3f5-ad962fd395bc","resolution":{"observed_at":"2026-08-07T14:08:19.472961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:19.182636Z","title":null,"venue":null,"work_id":"038b5458-4447-4be9-8b2e-45dc225d6869","year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:15.115835Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:354910e97b55aaea75d9e6eda3b892e0ae862b7126aaffb122428fd7ad7c1d3c","observation_id":"57925309-3ef2-48f2-9190-7e7f9d81cf31","resolution":{"observed_at":"2026-08-07T14:08:19.259176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:18.970008Z","title":null,"venue":null,"work_id":"1a736613-1fc9-48d6-8090-0bed10e9dfb3","year":2022},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:15.195497Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:4ff11089b651076f8b0723afc12b43929141d184d55e9adaa6f7fca5155fadce","observation_id":"0045c5c7-f944-4994-8438-0ece18e4e05c","resolution":{"observed_at":"2026-08-07T14:08:19.054089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:08:18.647577Z","title":null,"venue":null,"work_id":"c006b93c-212d-4bd0-946b-afd04fc82b5c","year":2023},"citing_paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:15.295893Z"},"links":{"citing_paper":"/paper/2505.19959"},"observation_digest":"sha256:02722ed7a0faa7011bcda5e933ab346bcfbbf45a2d710e637b0467cf31d6f63e","observation_id":"d7c3ac62-bf70-45f9-aae4-548b22167c97","resolution":{"observed_at":"2026-08-07T14:08:18.760719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19959","last_updated":"2025-07-30T16:46:12Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T01:20:29.114355Z","submitted_at":"2025-05-26T13:21:18Z","title":"MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":98,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":104},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 104 outbound references and 0 inbound Pith citation observations for arXiv:2505.19959."}