{"as_of":"2026-08-10T09:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b365e03dd41693a81e5fc8283576948041412f835574890cace8f8aacdf7cbaa","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:19:59.488074Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T22:16:42.836058Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:09:41.063430Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"cited_work":{"arxiv_id":"2507.08538","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.08538","snapshot_observed_at":"2026-07-04T08:09:41.063430Z","title":"Aleksandar Petrov, Emanuele La Malfa, Philip Torr, and Adel Bibi","venue":null,"work_id":"8ad2c179-4df5-4414-a758-3085bc944bad","year":2023},"citing_paper":{"arxiv_id":"2606.07020","last_updated":"2026-06-05T08:09:46Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T08:09:46Z","title":"MADE: Beyond Scoring via a Multilingual Agentic Diagnosing Engine for Fine-Grained Evaluation Insights","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-27T22:16:42.836058Z"},"links":{"cited_paper":"/paper/2507.08538","citing_paper":"/paper/2606.07020"},"observation_digest":"sha256:0a60d2bc32486a46d37356a76c5fe4f074efda122cec9f0881ab713253062bf5","observation_id":"d6b8e740-e173-4c1f-be05-b7e98a48b732","resolution":{"observed_at":"2026-07-02T16:57:09.878647Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"cited_work":{"arxiv_id":"2507.08538","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.08538","snapshot_observed_at":"2026-07-04T08:09:41.063430Z","title":"Aleksandar Petrov, Emanuele La Malfa, Philip Torr, and Adel Bibi","venue":null,"work_id":"8ad2c179-4df5-4414-a758-3085bc944bad","year":2023},"citing_paper":{"arxiv_id":"2606.21869","last_updated":"2026-06-20T04:12:29Z","snapshot_observed_at":"2026-08-07T01:52:47.874310Z","submitted_at":"2026-06-20T04:12:29Z","title":"The Language-Energy Divide: Measuring Energy Costs of Multilingual LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T12:12:45.853559Z"},"links":{"cited_paper":"/paper/2507.08538","citing_paper":"/paper/2606.21869"},"observation_digest":"sha256:ba82dc65afe7e1f38c5c66ad93bdac76966b38ea53d1d514ee3bd06a354c6189","observation_id":"fe845ad2-462c-4b79-9366-31d37fc2fe62","resolution":{"observed_at":"2026-07-04T08:09:41.065578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.08538/citation-record","integrity":"/paper/2507.08538/integrity","json":"/paper/2507.08538/citation-record.json","paper":"/paper/2507.08538"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.110456Z","title":null,"venue":null,"work_id":"a2f9685f-7d87-47e5-87f2-0e80cf051fc8","year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.286503Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:106da5b9b7fa0a71dfef249b31bee3f7dacb86efad8e367c1efb4562dfaa26d1","observation_id":"ea5dc9a5-023e-4979-9cef-feceaabe33a4","resolution":{"observed_at":"2026-08-06T18:20:00.116357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07445","last_updated":"2024-03-07T13:16:08Z","snapshot_observed_at":"2026-08-10T07:03:09.633462Z","submitted_at":"2023-09-14T05:56:49Z","title":"SIB-200: A Simple, Inclusive, and Big Evaluation Dataset for Topic Classification in 200+ Languages and Dialects","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07445","snapshot_observed_at":"2026-08-06T18:19:59.297703Z","title":"Alabi, Yanke Mao, Haonan Gao, and Annie En-Shiun Lee","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.297703Z"},"links":{"cited_paper":"/paper/2309.07445","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:fd87aaa3151fd9cbacf5f5ee9d27bdd2c969b3a9d2129612e92edaf94f2351c1","observation_id":"a3f2fbe0-9388-49c3-8b8f-62c6a6591335","resolution":{"observed_at":"2026-08-06T18:19:59.297703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03368","last_updated":"2025-01-23T17:57:28Z","snapshot_observed_at":"2026-08-08T14:58:02.421377Z","submitted_at":"2024-06-05T15:23:08Z","title":"IrokoBench: A New Benchmark for African Languages in the Age of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03368","snapshot_observed_at":"2026-08-06T18:19:59.301933Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.301933Z"},"links":{"cited_paper":"/paper/2406.03368","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:b0a0671599e126abd551c5ced986d033ac90191c79806237b08c329b1d5db49a","observation_id":"74157662-1675-4467-8bcc-c0cddf292b77","resolution":{"observed_at":"2026-08-06T18:19:59.301933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.313039Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.313039Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:274fdeb80c0db734119a2c7757f3df897d206b147278f63ef5fc418e034fa239","observation_id":"c5d39465-3f03-4cb6-9ff7-818308f676a7","resolution":{"observed_at":"2026-08-06T18:19:59.313039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.316902Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.316902Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:41cc514437f7b5d427431b8a13afac58e1341ea4d5366ee51ab7214addf2d704","observation_id":"73d888ff-7b96-4575-bfc2-f15485c3c338","resolution":{"observed_at":"2026-08-06T18:19:59.316902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.099529Z","title":null,"venue":null,"work_id":"0412bd4a-bcd4-49c8-a981-51c272ae01f4","year":2018},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.320491Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:b4ee92cea036176ed51d4dfb6bdbe843ae16d9fb7a0e01f59728fff50b735f4f","observation_id":"12900b22-1ea5-432d-9e9a-7d5c63184090","resolution":{"observed_at":"2026-08-06T18:20:00.103872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.324622Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.324622Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:182c45e6e2831f0f172db44eb5e9ab1a7d4ce85f8f1e93da10718e1638132cd2","observation_id":"f50d2a13-f26b-4a51-ab1f-a6eab9fb5177","resolution":{"observed_at":"2026-08-06T18:19:59.324622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00948","last_updated":"2024-12-01T19:46:40Z","snapshot_observed_at":"2026-07-06T19:59:47.022132Z","submitted_at":"2024-12-01T19:46:40Z","title":"Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00948","snapshot_observed_at":"2026-08-06T18:19:59.327369Z","title":"Alabi, Jonas Kgomo, Tyna Eloundou, Elizabeth Proehl, Kai Chen, Imaan Khadir, Naome A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.327369Z"},"links":{"cited_paper":"/paper/2412.00948","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:26bc6189f12eef67069abea77a94b63202a57395f3d4f26dd11660f47bc723b9","observation_id":"9495b29a-229b-43fe-b043-f51a8d8d39c5","resolution":{"observed_at":"2026-08-06T18:19:59.327369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.331114Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.331114Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:71a45b51d8866369f4903fae0fec9e79e10af75ceb47351ff19107e40ffb3ceb","observation_id":"b13a21ec-78e8-4094-977a-93b2acdc80f9","resolution":{"observed_at":"2026-08-06T18:19:59.331114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-06T18:19:59.345260Z","title":"https://doi.org/10.48550/arXiv.1803.05457 Think you have Solved Question Answering ? Try ARC , the AI2 Reasoning Challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.345260Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:175a63f949254fe547b4ea1bca2b57ba3a17913485b4317d882339ed08eadf4d","observation_id":"316ba190-ca4d-4be0-804d-3cb9a2a4f783","resolution":{"observed_at":"2026-08-06T18:19:59.345260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-06T18:19:59.348657Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.348657Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:eac3bfec211a4842b571036a311a634f1550e57c64170073e421010042631b8d","observation_id":"2dadaf57-a4d2-4e71-9310-6510fe1dfcf5","resolution":{"observed_at":"2026-08-06T18:19:59.348657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T18:19:59.352217Z","title":"https://doi.org/10.48550/arXiv.2110.14168 Training Verifiers to Solve Math Word Problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.352217Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:cb565512c7c2220b5bd3e544a60d3c403780f8eccd6f8fd903d8f0babc1f178c","observation_id":"2ccd1855-5476-4a80-a4e0-891fa333c7cc","resolution":{"observed_at":"2026-08-06T18:19:59.352217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T18:19:59.358937Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.358937Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:9177087197fef03df6c12e4a34fdb258fa28194b2579da5cdd6b502a2730f39a","observation_id":"40d3f81d-f183-46b7-9f57-013f7a0f15e9","resolution":{"observed_at":"2026-08-06T18:19:59.358937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.362269Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.362269Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:4272658fc9095aae8bc913e895dbf0d4557452662a5d0e90df82662adcaf9c8b","observation_id":"5b815c6d-6f48-449e-a8d6-69bbf1ee79f4","resolution":{"observed_at":"2026-08-06T18:19:59.362269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.370724Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.370724Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:4cf0a25f5f1a0d377971dae192e34081c62984843188b751852ffc9d6db1496b","observation_id":"68de6cc5-cffb-4362-b86b-306e8654b6e7","resolution":{"observed_at":"2026-08-06T18:19:59.370724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.373566Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.373566Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:8a810eb7c7b35d14eaee0275c80607d179d29db7005231c76d451e7abfe8f405","observation_id":"a3ebffed-3383-44b8-b7c6-1c8850839acb","resolution":{"observed_at":"2026-08-06T18:19:59.373566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.376093Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.376093Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:df8c582bfbc74100dda828480556c1b5a45a61b8f6e33476deb8f493a6e99247","observation_id":"40f01db5-8738-4e51-a15a-31e2aabac34a","resolution":{"observed_at":"2026-08-06T18:19:59.376093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.076994Z","title":"Eberhard, Gary F","venue":null,"work_id":"b8e74dde-334a-467c-b84d-5fb81e7de02d","year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.380102Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:6fbd930e8af0fbe443e24d7c0ff494418475b3499603f4cbe3e22deb1c5ee904","observation_id":"2d44566c-ee72-4965-bd9b-62fbb6cefabf","resolution":{"observed_at":"2026-08-06T18:20:00.084843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.061110Z","title":null,"venue":null,"work_id":"a65a061c-9454-468e-99d1-0051e491fd63","year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.387423Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:06280495cbb429c6c0969def9dc156373db4ee3e17c777f44a9de8ed60957a5d","observation_id":"371f5463-c200-41bf-a438-ba27692daa18","resolution":{"observed_at":"2026-08-06T18:20:00.065614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.674","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"f4e13376-f546-44b1-a077-a5198c7eb9ca","year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.397423Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:d9abeaf76a9711b887b07f34ab80a7e5cc9281fcd8f61ca1dd68485712e28db2","observation_id":"7fa8c939-2e20-4dbd-a464-da82de0f37d9","resolution":{"observed_at":"2026-08-06T18:19:59.597764Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.401528Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.401528Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:dadc0f0126bbf058be574564b6200819219cd94defd1f161e7c97ab662b50467","observation_id":"1d22288d-4ec5-4ebf-8937-6ec2001dda73","resolution":{"observed_at":"2026-08-06T18:19:59.401528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.404568Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.404568Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:5ab250298766a69f3a693b2eff8aba8628bf5133b86dc09ce68caaa5aa42ef25","observation_id":"d646cb52-a33e-4b21-9279-fee469173916","resolution":{"observed_at":"2026-08-06T18:19:59.404568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T18:19:59.420042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.420042Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:2637bd9cb7b88de249e4aceb03b424ad8441e6848b037864807f0e904e375d7f","observation_id":"2abf76eb-59de-4ed3-b413-675fdb541f32","resolution":{"observed_at":"2026-08-06T18:19:59.420042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-naacl.67","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"a90c103a-ac5f-4c33-ac17-3ddc4732f2c8","year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.422684Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:628add2ebdeb87bed31def1c3743ad92a533e4c75e8937e54fafef5eb326871f","observation_id":"2a3720dd-1d5f-4fa7-a27b-a521650b0d69","resolution":{"observed_at":"2026-08-06T18:19:59.572001Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T18:19:59.425715Z","title":"https://doi.org/10.48550/arXiv.2009.03300 Measuring Massive Multitask Language Understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.425715Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:deeac0bdbd6c571ae3bf7aa5e220e503db8ab3069a5756477bf49c17796dbb82","observation_id":"3f6dd766-7819-4598-9c5c-3e5fee4c167e","resolution":{"observed_at":"2026-08-06T18:19:59.425715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T18:19:59.429610Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.429610Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:119cb2f3aa9045dc265e50e4200731817f10b815d87fd09812313bc9f643e338","observation_id":"b0ccd95b-80db-4b7d-ae55-6aa4eaa3fd47","resolution":{"observed_at":"2026-08-06T18:19:59.429610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16039","last_updated":"2023-08-02T00:39:25Z","snapshot_observed_at":"2026-08-04T18:29:36.809656Z","submitted_at":"2023-07-29T18:01:46Z","title":"Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16039","snapshot_observed_at":"2026-08-06T18:19:59.432414Z","title":"Rossi, and Thien Huu Nguyen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.432414Z"},"links":{"cited_paper":"/paper/2307.16039","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:0175ba08f4cd000d334822fd92402f89545cc77102fb32801bab5f1aaec67f8b","observation_id":"9f4be4c7-7d94-47bf-b8bf-a289c9cc45c2","resolution":{"observed_at":"2026-08-06T18:19:59.432414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.435453Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.435453Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:c50bb6f351eb7ed5636d30cc1d7338916e20d9509637112aab06dd0926e1d628","observation_id":"6abaf680-c7f8-44c5-9d50-82fecfaff93b","resolution":{"observed_at":"2026-08-06T18:19:59.435453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.039582Z","title":null,"venue":null,"work_id":"3b19aeba-aaf1-4bca-b31a-ffda5c099a87","year":2014},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.438133Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:09b97b9d73f9234d764bf25aae43950265cb97de4f111e70180e0c2168ed292e","observation_id":"edc97634-f5c4-44aa-b52d-5005161a89a1","resolution":{"observed_at":"2026-08-06T18:20:00.049239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07978","last_updated":"2025-06-07T11:23:49Z","snapshot_observed_at":"2026-07-06T16:47:12.709738Z","submitted_at":"2023-11-14T08:10:14Z","title":"AfroBench: How Good are Large Language Models on African Languages?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07978","snapshot_observed_at":"2026-08-06T18:19:59.443625Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.443625Z"},"links":{"cited_paper":"/paper/2311.07978","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:42aae6cdd9bd5cc45164d3e4f61b33a20dbafec75625045d014de6c3c8f4879d","observation_id":"f2fa17cc-eb8c-4d46-b7b0-47104a8c9d1c","resolution":{"observed_at":"2026-08-06T18:19:59.443625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.446447Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.446447Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:b08fd16ea55b6e9ce3a44be21533014f5b152ea09f686a3d1bc12b39821742a0","observation_id":"0d0cf63a-55ed-4e2c-a021-74a74d668996","resolution":{"observed_at":"2026-08-06T18:19:59.446447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.027100Z","title":null,"venue":null,"work_id":"84f2742f-cc96-4b01-80c0-41379f88c121","year":2020},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.449243Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:7fcad31dd5f6a2edde317fe35d2498970891029bcb00e3c85454db406fdb44da","observation_id":"09b840e1-b651-4402-bccc-354a17892cfa","resolution":{"observed_at":"2026-08-06T18:20:00.031481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:20:00.013188Z","title":null,"venue":null,"work_id":"6d72c058-4486-4d58-9d78-6b79b50c5d9e","year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.451844Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:b69c9a23b40566db90ff75d2d6b4df9e5e3342e6d245813e953b9e94250dbdf1","observation_id":"ea9e2e71-2600-448a-b84c-7cbb86697667","resolution":{"observed_at":"2026-08-06T18:20:00.018207Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.454603Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.454603Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:84ddcf4d853384e76ab2cb7cb7159c74b4f724953b40e490d6d161a556ec2fb0","observation_id":"ec21d80d-d331-42aa-8f16-d7cbebd7a210","resolution":{"observed_at":"2026-08-06T18:19:59.454603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.986899Z","title":null,"venue":null,"work_id":"4849d359-8e03-4492-bba2-8c959a3f02a4","year":2021},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.457204Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:59da711ff48daa4c73f2f348c8e1e3d40f311097ff25db0d412f1a4c45dc6aa4","observation_id":"2fa77bbf-7f2e-4af4-9480-bbf1bc74644e","resolution":{"observed_at":"2026-08-06T18:20:00.000793Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-06T18:19:59.459779Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.459779Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:15f8fb4974c6f563456a545a058b3796b489103a411f82009b40548e967ad3b8","observation_id":"f4dbf787-c595-4360-92b2-1435ec378768","resolution":{"observed_at":"2026-08-06T18:19:59.459779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-08-09T14:26:53.957065Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-08-06T18:19:59.462845Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.462845Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:960532825b0fa79d62c76b93bc56cc15e6595e88629c571f4a386ce212e60a45","observation_id":"75c7a333-5511-4883-9966-214c158b7954","resolution":{"observed_at":"2026-08-06T18:19:59.462845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-06T18:19:59.466179Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.466179Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:7144e9a6b053d0f00a0c30b00189c7bf5e1e4bb6499fc1fbc4a5f5764fac0b83","observation_id":"c39204d1-abe3-4fc3-a480-15c1b4b0e12c","resolution":{"observed_at":"2026-08-06T18:19:59.466179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08928","last_updated":"2024-10-17T17:58:53Z","snapshot_observed_at":"2026-08-08T23:44:04.541111Z","submitted_at":"2024-10-11T15:53:24Z","title":"Towards Multilingual LLM Evaluation for European Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08928","snapshot_observed_at":"2026-08-06T18:19:59.469267Z","title":"o hler, Ren \\'e J \\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.469267Z"},"links":{"cited_paper":"/paper/2410.08928","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:448d557f6dcfdb6f0281b2f250ecdd4f71eb671cbc3e86119222d7b24971ce2e","observation_id":"9e9bfe70-e9d4-449f-82b4-ed9ee62f7b75","resolution":{"observed_at":"2026-08-06T18:19:59.469267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08928","last_updated":"2024-10-17T17:58:53Z","snapshot_observed_at":"2026-08-08T23:44:04.541111Z","submitted_at":"2024-10-11T15:53:24Z","title":"Towards Multilingual LLM Evaluation for European Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08928","snapshot_observed_at":"2026-08-06T18:19:59.472849Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.472849Z"},"links":{"cited_paper":"/paper/2410.08928","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:aaa59fb63605c1fce751958694d5f69e3b478f10bac8767b399824378ac8304a","observation_id":"b138c725-3ee2-4ae8-94b3-f9fa36f6f61f","resolution":{"observed_at":"2026-08-06T18:19:59.472849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.475927Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.475927Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:5eff84a9cca75a39276ac87aa8eefa3c5a404ae3e30e889c584d25594e56facc","observation_id":"492a34b0-5344-4c66-b1ad-0411e78bc728","resolution":{"observed_at":"2026-08-06T18:19:59.475927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.478444Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.478444Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:d7119f461c57f7afa2ad706289a72ac4b3d6e533f9c8179da48fe7815d45fa31","observation_id":"47f9d69e-db9d-46d3-8415-ca814bdfb838","resolution":{"observed_at":"2026-08-06T18:19:59.478444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-06T18:19:59.481633Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.481633Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:6f677e0ea8ca72a8a2978b7160b0fe5e11f229f9f467cd2ca032c7682dc30104","observation_id":"92444df7-09a0-46c4-bbfb-5e41e53ca32a","resolution":{"observed_at":"2026-08-06T18:19:59.481633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.484979Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.484979Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:2e329bf588b8dd046ff9533a51bafd4570c2a49306979f536917e666022b9c52","observation_id":"a693c908-41b3-4107-baa7-f147dc88334d","resolution":{"observed_at":"2026-08-06T18:19:59.484979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.488074Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T18:19:59.488074Z"},"links":{"citing_paper":"/paper/2507.08538"},"observation_digest":"sha256:75056db7523916a7f47f6ca63c1247514ca1e63f553ae3493600dfbd08a54fcf","observation_id":"15b845e3-1c0e-4bc5-a390-2e997e86499a","resolution":{"observed_at":"2026-08-06T18:19:59.488074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.08538","last_updated":"2025-07-11T12:38:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T14:58:41.249277Z","submitted_at":"2025-07-11T12:38:02Z","title":"The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 2 inbound Pith citation observations for arXiv:2507.08538."}