{"as_of":"2026-08-09T22:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d4c2ce0ac972a7b22020d9934bb197a3a02dafdfbb9abb491878194373192551","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T06:00:10.327109Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.01006/citation-record","integrity":"/paper/2508.01006/integrity","json":"/paper/2508.01006/citation-record.json","paper":"/paper/2508.01006"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T06:00:10.281920Z","title":"Preprint, arXiv:2501.12948","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.281920Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:e75a43c88b42ca4158c1b8dd247c7f54eaf574720692ae54cac54dd9920ea386","observation_id":"548a52aa-2253-4475-81d1-0927df9c063e","resolution":{"observed_at":"2026-08-06T06:00:10.281920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02768","last_updated":"2026-04-30T13:20:38Z","snapshot_observed_at":"2026-07-06T21:03:50.078667Z","submitted_at":"2025-04-03T17:05:50Z","title":"MultiBLiMP 1.0: A Massively Multilingual Benchmark of Linguistic Minimal Pairs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02768","snapshot_observed_at":"2026-08-06T06:00:10.296880Z","title":"Preprint, arXiv:2504.02768","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.296880Z"},"links":{"cited_paper":"/paper/2504.02768","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:9af1cd1db8f4e0868cc4d410031168ff490b125fea7ef23935ba2242593dfc64","observation_id":"47537837-aa1d-4b6d-8a6b-7c73a663c655","resolution":{"observed_at":"2026-08-06T06:00:10.296880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07474","last_updated":"2024-12-12T07:21:19Z","snapshot_observed_at":"2026-08-08T03:05:33.558929Z","submitted_at":"2024-11-12T01:26:41Z","title":"Controlled Evaluation of Syntactic Knowledge in Multilingual Language Models","version":2},"cited_work":{"arxiv_id":"2411.07474","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.07474","snapshot_observed_at":"2026-08-06T06:00:10.368393Z","title":"Controlled Evaluation of Syntactic Knowledge in Multilingual Language Models","venue":"cs.CL","work_id":"d3b0e394-9c89-418b-ab3c-4154c50d5286","year":2024},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.300890Z"},"links":{"cited_paper":"/paper/2411.07474","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:85f72a8b5ccf6b6a5432a810624116dda45fe4b88fb416990a63c3397ec2e941","observation_id":"f6ac2c71-d32d-4fac-8f5a-8aa11ec5954a","resolution":{"observed_at":"2026-08-06T06:00:10.374786Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:17.003895Z","title":"In Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing: System Demonstrations, pages 175–184, Online and Punta Cana, Dominican Republic","venue":null,"work_id":"075ce614-6a9d-4c26-80fd-fdec98aca639","year":2021},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.304908Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:8b67d138ffa3f1331694741cf2d681c63e543978ac0d42c41278dd9d952cbe17","observation_id":"9b21b02a-1d0d-4cfb-b3bb-a103a75aaca7","resolution":{"observed_at":"2026-08-06T06:00:17.008156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.980800Z","title":"In Proceedings of the 2022 Conference on Empirical Methods in Natural Language Processing, pages 4606–4634, Abu Dhabi, United Arab Emirates","venue":null,"work_id":"e8489c7a-84e5-4188-bd7e-023e5486b179","year":2022},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.316058Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:6768921dae45888c83fc5f8aa0aaa446d79fda0a44d97d8d4867e178d22a6996","observation_id":"325c05ce-bb73-4f46-91eb-d7f90fe50223","resolution":{"observed_at":"2026-08-06T06:00:16.984655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.969582Z","title":"https: //huggingface.co/large-traversaal/ Alif-1.0-8B-Instruct","venue":null,"work_id":"c801e162-5709-4e89-bdac-1162efce1727","year":2025},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.319635Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:8aad0de85f905a2629c1852e5237e80c389bd1f704c84e41a4a7c9b16fc3cc93","observation_id":"658c8df3-eb7a-4f0c-90ec-0c39dc780deb","resolution":{"observed_at":"2026-08-06T06:00:16.973213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.958333Z","title":"In Proceedings of the 2021 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies, pages 483–498, Online","venue":null,"work_id":"81663400-8a3f-48c4-bbaa-92bbdd220ce4","year":2021},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.323430Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:4b0d411a8770607ce9eae0a6ba71e10c919d3254548e8501da4af244288bbc97","observation_id":"d6c2eb2c-9940-4d45-9194-ce4a9ebbffa2","resolution":{"observed_at":"2026-08-06T06:00:16.962267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T06:00:10.285644Z","title":"CoRR, abs/1810.04805","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.285644Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:e38554b40ec9bffff68490805402deada155032aba8a1144cad5412f76f6384a","observation_id":"1a95b647-5a3a-400a-b0b8-921d650a2b73","resolution":{"observed_at":"2026-08-06T06:00:10.285644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.946140Z","title":null,"venue":null,"work_id":"c8a1341c-34b1-4055-99e4-f7f0e24901a4","year":2021},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.327109Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:9b744cca2d73dde440a150490be3f97c527334dc0f1fdf35e61897e9c0c9ae61","observation_id":"833c7619-d4b4-4f6c-8b1c-ef0c6e9dde59","resolution":{"observed_at":"2026-08-06T06:00:16.950764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:17.016280Z","title":"In Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing, pages 7038–7051, Online and Punta Cana, Dominican Republic","venue":null,"work_id":"b60b4150-9f7c-4fc4-aec3-2ba462244381","year":2021},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.293383Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:593b4cd8d4c6eb5eecb4ec56252d1e71be79ae09e73f37e3612ca82907ae10e2","observation_id":"903cf07f-df61-470c-a178-bc27745dfb5a","resolution":{"observed_at":"2026-08-06T06:00:17.020156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01786","last_updated":"2023-05-29T16:40:37Z","snapshot_observed_at":"2026-08-06T03:54:27.439090Z","submitted_at":"2022-11-03T13:19:32Z","title":"Crosslingual Generalization through Multitask Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01786","snapshot_observed_at":"2026-08-06T06:00:10.308640Z","title":"arXiv preprint arXiv:2211.01786","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.308640Z"},"links":{"cited_paper":"/paper/2211.01786","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:b0b0fba4076b7e5b4f8647afc19169c7ad08edb43685d1730c38c7ee6068d991","observation_id":"62d44409-ffa4-4a70-acb5-b3d8dcc8b068","resolution":{"observed_at":"2026-08-06T06:00:10.308640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.991994Z","title":"In Findings of the Association for Computational Linguistics: EACL 2023 , pages 1581–1594, Dubrovnik, Croatia","venue":null,"work_id":"7214a3cf-0e3c-4ff6-ad68-5dbc55077650","year":2023},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.312630Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:98688e5afee1cc5c4a895d1de71ea19f0937e589afcd52cfead8ad51f4b6e175","observation_id":"12c83f7b-ce1b-4839-b665-57a31b8abe16","resolution":{"observed_at":"2026-08-06T06:00:16.995724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T06:00:10.289493Z","title":"Preprint, arXiv:2407.21783","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.289493Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:54b0b9837d7f8a661ef3d375ec159f8261da376d087e23701dc06b04291487db","observation_id":"c3f58f95-83ac-4dde-b071-2c9f97a73365","resolution":{"observed_at":"2026-08-06T06:00:10.289493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:10.277918Z","title":"Preprint, arXiv:2506.13487","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.277918Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:0d874ae0d19502761d44eb0a68b81babff1729ab63924e776dd43522b21b0345","observation_id":"b6b58527-6c82-42f4-836d-554e91e84c54","resolution":{"observed_at":"2026-08-06T06:00:10.277918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T03:07:09.067251Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2508.01006."}