{"as_of":"2026-08-10T15:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:da15e90f60adb085eacf7655d6db3d1e614801bf2edba3094859d6d407f1d9a7","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:31:20.747562Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T09:37:05.659296Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02280","snapshot_observed_at":"2026-08-03T09:37:05.659296Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.13346","last_updated":"2026-06-10T18:20:09Z","snapshot_observed_at":"2026-08-08T14:59:13.379247Z","submitted_at":"2026-01-19T19:30:35Z","title":"AfroScope: A Framework for Studying the Linguistic Landscape of Africa","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T09:37:05.659296Z"},"links":{"cited_paper":"/paper/2506.02280","citing_paper":"/paper/2601.13346"},"observation_digest":"sha256:3ed20c294cf9cfde8fe6156149678ba7cc89c3d5c684e5e2df27499447f59be2","observation_id":"7d8b5202-beec-4f59-9557-28f4fc1c0040","resolution":{"observed_at":"2026-08-03T09:37:05.659296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02280/citation-record","integrity":"/paper/2506.02280/integrity","json":"/paper/2506.02280/citation-record.json","paper":"/paper/2506.02280"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:16.567115Z","title":"Masakhaner: Named entity recognition for african languages","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.567115Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:8a7e14249ca81d23d6512a2d2d9ab22ebe9ffff3b3da7ede94a640d670c93096","observation_id":"24af49ee-07cb-4fb2-a3ce-52da0a2f089d","resolution":{"observed_at":"2026-08-07T11:31:16.567115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.500564Z","title":"Alabi, David Ifeoluwa Adelani, Marius Mosbach, and Dietrich Klakow","venue":null,"work_id":"47c64ee1-f1d9-4188-8bf8-a3eb12301385","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.688013Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:735acaf9b03c41be4462d122d85c3f4b05a94d3a45eda252ffc3886eecc19550","observation_id":"8a87328d-07dd-4ac8-b3d0-0c9ca832541a","resolution":{"observed_at":"2026-08-07T11:31:21.506806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.482902Z","title":"A ra BERT : Transformer-based model for A rabic language understanding","venue":null,"work_id":"0da1fb8c-0c03-4abd-8adb-b7caa5626df3","year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.796462Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:3f245c8d89ea96d8856c662da2dbfa79ce1d15b510d377bc81fc739c19de109d","observation_id":"849748bf-50e9-45db-8b50-0b4f8d56c12b","resolution":{"observed_at":"2026-08-07T11:31:21.488624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.467166Z","title":"A ra GPT 2: Pre-trained transformer for A rabic language generation","venue":null,"work_id":"2726f7ed-8ab2-4e96-989f-59c7e17e8e1f","year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.871105Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:9f26d88defd2d9a2f61132dce916056fd5162d22916fb33074d3daefd56fd55a","observation_id":"56e5ad4d-bf7b-4775-a034-46aa193ca82c","resolution":{"observed_at":"2026-08-07T11:31:21.472376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.449749Z","title":"The world's writing systems, 2024","venue":null,"work_id":"baa2129a-08ae-4646-8034-9cd07b7e8050","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.957053Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:e68c3379ec44eab41240a022abd8580b7996dbd646370ce54b4bd3b74c48846c","observation_id":"759a55e5-1421-44df-baba-e9b58fe31695","resolution":{"observed_at":"2026-08-07T11:31:21.455385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.062830Z","title":"Clark, Dan Garrette, Iulia Turc, and John Wieting","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.062830Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:cb06a4bb217784f29949b9cddaded5e098cf4538ea4076b6e47880aae6078688","observation_id":"87ff6b22-cb72-4a9c-9043-5d58e5d84754","resolution":{"observed_at":"2026-08-07T11:31:17.062830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.131375Z","title":"Unsupervised cross-lingual representation learning at scale","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.131375Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:c992560078c5121a42b095cd7ecf316b955d52978c72aabef86752f5a0db57cc","observation_id":"1f98785a-7b38-4aa3-9011-bfd5cb1f34a7","resolution":{"observed_at":"2026-08-07T11:31:17.131375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.432931Z","title":"Costa-jussà, James Cross, Onur Çelebi, Maha Elbayad, Kenneth Heafield, Yan He, Elahe Kalbassi, Linlu Wang, Long Wang, Shuo Zhang, Angela Fan, et al","venue":null,"work_id":"0d547cf9-2b81-4d7b-82e3-4bf6df8a0884","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.199590Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:bf034d5132f5890a025581a355c97e564e9bd4150955b9714eccda1e455f37f2","observation_id":"3d40d5b4-26a0-4cfa-8130-cde6496f70a0","resolution":{"observed_at":"2026-08-07T11:31:21.438752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.275503Z","title":"I ndic BART : A pre-trained model for indic natural language generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.275503Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:9a62e583569cf6939b72ae77c632e2f14ca15615766729b9d75199679d6d99b1","observation_id":"8b865532-6f80-4e4b-b15a-31060f38b0eb","resolution":{"observed_at":"2026-08-07T11:31:17.275503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.416755Z","title":"Dai, Jonathan H","venue":null,"work_id":"e8e3c4fd-9b0d-4b65-ad67-ca1bf997dd82","year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.353562Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:f4f8c88f0ecd06f861bcdc4db769e7782919d19cdae863e022788c02e0286f4a","observation_id":"eb06d123-76e1-4b6e-b83b-793b9f6b5225","resolution":{"observed_at":"2026-08-07T11:31:21.421435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T11:31:17.454634Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.454634Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:f26fadf96df99b534aedb9805f396d1068ae4bc276d5b04742dd8988c78f641c","observation_id":"85b361e1-b103-4b4d-8535-7750762f7468","resolution":{"observed_at":"2026-08-07T11:31:17.454634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.536207Z","title":"BERT : Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.536207Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:4187275ff8f33070ade061b57846f3ae4002588acd41b0807e8f464fa2fe08cd","observation_id":"f4977833-cb77-4775-ae8b-d4f83a108af5","resolution":{"observed_at":"2026-08-07T11:31:17.536207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.635908Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.635908Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:71bd256db800cb6942a833d7f84e596ef0288f601840bcd29b9829f394db068d","observation_id":"cab97324-99d7-4dad-ba90-b3e0143a9d3a","resolution":{"observed_at":"2026-08-07T11:31:17.635908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.380478Z","title":null,"venue":null,"work_id":"932b933a-7762-4371-8c0d-b3c1c7ed398d","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.704637Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:f36dd64bf29611cb907eb10247d9fb364afa8cc9729a577f8f17b138a9624f97","observation_id":"8d6450d8-c029-4405-8f80-92052358a36f","resolution":{"observed_at":"2026-08-07T11:31:21.385179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.364262Z","title":"Ethnologue: Languages of the world, 2025","venue":null,"work_id":"82dffb75-3277-494e-bce0-4d0668827903","year":2025},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.751526Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:949520b3c8ecd195dd4c0ea305e911a22adf2ec6e2d9e61cc75424af721ec474","observation_id":"ffda6658-4dcf-41ad-b70c-21fb7216e327","resolution":{"observed_at":"2026-08-07T11:31:21.369840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.822580Z","title":"Language-agnostic BERT sentence embedding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.822580Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:0705c7dbcd594e9d68e1a5cf858a6e9e4ea7fa061b87a4c6b266cb200932b341","observation_id":"6382c1fd-89f1-4912-abc1-f26cdb4af5a1","resolution":{"observed_at":"2026-08-07T11:31:17.822580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.940518Z","title":"Guerreiro, Duarte M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.940518Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:5825688e3ea682e20c4ffd900f8574bdf2ae604afe9cf35f6074485184447d00","observation_id":"1adfb3d7-6e25-4993-8e7e-8ab058755d73","resolution":{"observed_at":"2026-08-07T11:31:17.940518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T11:31:18.023742Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.023742Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:94e6a807424e1278f93512c1c4a18e3f9d29088550c424a565bb09d7da156ec1","observation_id":"8c54d4ca-0db1-48a4-acb5-c7226d8de970","resolution":{"observed_at":"2026-08-07T11:31:18.023742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.122121Z","title":"Glot500: Scaling multilingual corpora and language models to 500 languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.122121Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:eecb8aa169fa745ff78ba223544e0e266d8e11778b5973ed1cdd24f11ebb1365","observation_id":"7d5310d6-1dca-4b94-b880-517890fd6eb8","resolution":{"observed_at":"2026-08-07T11:31:18.122121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.192540Z","title":"A fri T e VA : Extending ?small data? pretraining approaches to sequence-to-sequence models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.192540Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:92e972021776558bf19261361a10a8d17e24d559b6066010c0d241f82feb55b3","observation_id":"cf224bba-82b6-41a1-8ed4-868b53209f75","resolution":{"observed_at":"2026-08-07T11:31:18.192540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.293791Z","title":"I ndo LEM and I ndo BERT : A benchmark dataset and pre-trained language model for I ndonesian NLP","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.293791Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:ab9d16962e03f4a019d65d005abc970003541dfd21b7168bc5c6af38d3086019","observation_id":"4acd185a-5fa6-4043-b52d-b158168a80ec","resolution":{"observed_at":"2026-08-07T11:31:18.293791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.328892Z","title":"Cross-lingual language model pretraining","venue":null,"work_id":"eba8892c-50c7-4e4f-a46b-62d4c75749e6","year":2019},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.368440Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:a72e148e47740869c1dcee0f9ec731f38f5c484e02f8b100c8687956946ee507","observation_id":"1607e442-d972-4c85-9855-d7013fa5c9ab","resolution":{"observed_at":"2026-08-07T11:31:21.333574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-07T11:31:18.445979Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.445979Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:9dd7e9993f58c1a2fe3d7b5292efe8c42329a69ae3ed9a6366a27bf2b3a64cbf","observation_id":"46ec1e55-256e-4a9e-93e0-e6f19d44e645","resolution":{"observed_at":"2026-08-07T11:31:18.445979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T11:31:18.569627Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.569627Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:9dd559c5eaaf7465584a49d663122fdd116529852c41e16c24bce05ec65bf190","observation_id":"596bd67d-89e2-4ac1-9648-bf70aa533c77","resolution":{"observed_at":"2026-08-07T11:31:18.569627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.705580Z","title":"Scaling laws for fact memorization of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.705580Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:61e944dff32f1d79e55e3bad0d559b20fd00de34b2c08cd9b271a765988f881c","observation_id":"c56b29f5-1779-437c-897a-ba36dc60feca","resolution":{"observed_at":"2026-08-07T11:31:18.705580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.710364Z","title":"F in GPT : Large generative models for a small language","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.710364Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:9063d5705bd397e75b3bfdd3096936361da69d096ad0ac413f6e1d447ce1b919","observation_id":"a2e314a6-30ea-4a73-ba0d-8feff75fbc06","resolution":{"observed_at":"2026-08-07T11:31:18.710364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.766573Z","title":"A ra T 5: Text-to-text transformers for A rabic language generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.766573Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:6ff39fa7bcc8fd0981c6394c6d9b5baf0d8429fbdae42faf62950f11912209d6","observation_id":"de7d1893-e333-43e9-babc-8fc41a9a51dd","resolution":{"observed_at":"2026-08-07T11:31:18.766573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.afrinlp-1.11","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.902635Z","title":"Small data? no problem! exploring the viability of pretrained multilingual language models for low-resourced african languages","venue":null,"work_id":"406ea3b5-a9fc-4731-ab20-824945af7822","year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.840606Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:0695424b53702bc8f9519fc21506677959179f05730a7b14e6ba9cf29f78dcd9","observation_id":"6f4d2d0a-7a97-4d77-a12e-300c63d5ce52","resolution":{"observed_at":"2026-08-07T11:31:20.908745Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.303675Z","title":"Gpt-4 technical report, 2023","venue":null,"work_id":"b6a0f3e6-c938-4a8a-aa2a-458bbf80758a","year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.913026Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:fc8b91c48e1acc1e479079a7d94537d854942a382b8d61cdcd73c73f9c4008bb","observation_id":"90c0fd41-2149-4724-b0c9-5235840473b5","resolution":{"observed_at":"2026-08-07T11:31:21.308358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:19.014252Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.014252Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:1b1d65e593e6274e7adc7f92e4a4b051c1fb389810bb8808a03a1ffccb66fa84","observation_id":"03f1b966-88f7-4f75-ad5c-ede8fa14ca70","resolution":{"observed_at":"2026-08-07T11:31:19.014252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.275867Z","title":"Bert multilingual model readme, 2019","venue":null,"work_id":"707a7b86-f096-4ab2-9ec5-252d4806e8d4","year":2019},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.099793Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:5b43624abd6a9bd89a567d70afa20bda7f00d05058e43554dbab34273f92e7d4","observation_id":"b5cd3bca-a957-4e1c-8dd6-a857ca891e1a","resolution":{"observed_at":"2026-08-07T11:31:21.280890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.260119Z","title":"Multilingual t5: Massively multilingual pre-trained text-to-text transformer, 2021","venue":null,"work_id":"6a12b21c-dd84-44a5-bf9b-fedcaa465b6b","year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.174613Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:1cb4b4017582ee783057e504ddb956d95b3c734120a09a4a457e45874adfb412","observation_id":"5880c09b-e1eb-4d49-ab35-6a34003be8ae","resolution":{"observed_at":"2026-08-07T11:31:21.265242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.244321Z","title":"NLLB-200 : Distilled 600m-parameter model of No Language Left Behind ( NLLB ), 2022","venue":null,"work_id":"3bdb9159-5d7d-4629-8c88-4c74e33ff7a2","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.236141Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:44df1e794fc2c863c4db7252f2319b69e5c87f7d92ff9fadc423fe7785699485","observation_id":"ba1d6127-8c37-422e-b29f-b27e20dc8b41","resolution":{"observed_at":"2026-08-07T11:31:21.249399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:19.320569Z","title":"How good is your tokenizer? on the monolingual performance of multilingual language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.320569Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:fc279ea91ffadf4a8d8c0b100eeb192d9d683d75c31ea225951a967d316534a8","observation_id":"4f8376fa-4cab-4c36-afa5-49c46958233a","resolution":{"observed_at":"2026-08-07T11:31:19.320569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T11:31:19.398596Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.398596Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:438b6d2f727a5d614dd34b603c00b16458aafac587ca56cd3a866f1990812f3b","observation_id":"078b2b4c-c876-4dee-85d4-a51659012104","resolution":{"observed_at":"2026-08-07T11:31:19.398596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:19.577749Z","title":"The language barrier: Dissecting safety challenges of LLM s in multilingual contexts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.577749Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:a52b9aa129c5715799b6ae4fdac32bf8a90da432426b6e30d39a3dfc6f804901","observation_id":"d0920318-6f80-435e-8453-24227f48b885","resolution":{"observed_at":"2026-08-07T11:31:19.577749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.217501Z","title":"Gemini: A family of highly capable multimodal models, December 2023","venue":null,"work_id":"41c6f80b-83c7-49c6-aeae-81a8954abfbd","year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.672142Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:e6b7ac71325418966eca9a0b297d66127805ffbbf38cc880eed8286e649160af","observation_id":"23004449-b85d-4a41-9d3f-c47e908c8c05","resolution":{"observed_at":"2026-08-07T11:31:21.222377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.199145Z","title":"Costa-jussà, James Cross, Onur Çelebi, Maha Elbayad, Kenneth Heafield, Kevin Heffernan, Elahe Kalbassi, Janice Lam, Daniel Licht, Jean Maillard, et al","venue":null,"work_id":"c28baef2-1581-43c2-a561-d5070b4e6aec","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.777258Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:707e8b882fb2c4ecf383d81e6ad6428082379bb23feafe9bee60eee07796e541","observation_id":"20e55edb-7efa-4583-841d-149e9b5181bb","resolution":{"observed_at":"2026-08-07T11:31:21.206621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13737","last_updated":"2024-06-23T12:06:27Z","snapshot_observed_at":"2026-08-10T04:09:57.084163Z","submitted_at":"2024-03-20T16:43:42Z","title":"EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task Evaluation","version":4},"cited_work":{"arxiv_id":"2403.13737","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13737","snapshot_observed_at":"2026-08-07T11:31:21.038499Z","title":"EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task Evaluation","venue":"cs.CL","work_id":"8e44864d-d0cb-426b-a50a-99bba4a5cae7","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.896131Z"},"links":{"cited_paper":"/paper/2403.13737","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:3ca19c4ce563087995b199d457bdf96658a0e95936f97b23901becc20a5bc7c6","observation_id":"ef751f80-1672-4bcd-a625-b5abee9a1909","resolution":{"observed_at":"2026-08-07T11:31:21.043388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.182701Z","title":"E thio LLM : Multilingual large language models for E thiopian languages with task evaluation","venue":null,"work_id":"ae452cc8-50bc-4989-9b50-8dd68a3dacd0","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.988573Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:c9f23492d70a2d04f4b76df344f73eeeb5b7c25ac3b8bbbcfcd65bc57ff631dc","observation_id":"87f985d4-aa3c-4719-b3c8-61fb6e5c02c3","resolution":{"observed_at":"2026-08-07T11:31:21.187353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.167886Z","title":"E thio MT : Parallel corpus for low-resource E thiopian languages","venue":null,"work_id":"dce2ee6f-f9fb-40ff-9dfe-d6b744ff1e54","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.074637Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:c46a550261bb0500ec6553a9bd5aef42f707053bc9027468f9e4f159cd77c427","observation_id":"97667762-d008-4c3d-a254-e9977070e972","resolution":{"observed_at":"2026-08-07T11:31:21.172576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.207198Z","title":"Aya model: An instruction finetuned open-access multilingual language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.207198Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:811d3e129b63ec580857023a0bc63e3e1d18393de947afbe0a9c023ef4941768","observation_id":"83dcaf8f-26d2-4c35-bbfe-b1ef1e03b5a5","resolution":{"observed_at":"2026-08-07T11:31:20.207198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03350","last_updated":"2024-12-28T09:18:36Z","snapshot_observed_at":"2026-08-09T21:50:12.548839Z","submitted_at":"2024-11-04T04:43:01Z","title":"A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03350","snapshot_observed_at":"2026-08-07T11:31:20.338729Z","title":"A comprehensive survey of small language models in the era of large language models: Techniques, enhancements, applications, collaboration with llms, and trustworthiness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.338729Z"},"links":{"cited_paper":"/paper/2411.03350","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:9ce4f2849cafe2946b3474b23d70de28fcdb76efa07edb3fe0faf4d782d73398","observation_id":"31136607-4831-46bb-ad2a-0bc3b980b891","resolution":{"observed_at":"2026-08-07T11:31:20.338729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.143019Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"62c9ae29-4baa-408f-999b-9483872c17e3","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.389951Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:43b86751b8eae46e3323d5d9eef76327c18140668caf77177ceee9f962173d18","observation_id":"696e49c9-e0f2-4690-816f-4c0777291ad4","resolution":{"observed_at":"2026-08-07T11:31:21.147854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-07T11:31:20.468482Z","title":"Bloom: A 176b-parameter open-access multilingual language model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.468482Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:cf17cd022909669f2c21af4a82f1cb1297fbf224bfe7ad885d490e7ab8ead971","observation_id":"b18aaf85-cd10-4528-bcf8-97b7a9b56839","resolution":{"observed_at":"2026-08-07T11:31:20.468482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.564776Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.564776Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:f14db9c9ac1cc2d25b7d69686dcdc6cee1f442e173ed95ed0d817968470a8cab","observation_id":"e4c0cbba-9496-44c1-b415-289b4014c78e","resolution":{"observed_at":"2026-08-07T11:31:20.564776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.640827Z","title":"m T 5: A massively multilingual pre-trained text-to-text transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.640827Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:6ab0fed3eb4c9c1dfe00b9f7952235e50ea54ce251cbb4be3d8dd9f9c4d3b266","observation_id":"cda4dac2-4240-426a-b36d-0b09db8f689b","resolution":{"observed_at":"2026-08-07T11:31:20.640827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.747562Z","title":"B y T 5: Towards a token-free future with pre-trained byte-to-byte models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.747562Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:89d445bc7968d55157e8b433028ea4a3dbad1eda5918e1b8e0db7f497a9a9a65","observation_id":"5d8fe745-4ecd-4917-a8ae-86e683895cdd","resolution":{"observed_at":"2026-08-07T11:31:20.747562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T21:49:55.650790Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2506.02280."}