{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2023:FYVKLUW7BMCWJQOCLPIKKF4ICR","short_pith_number":"pith:FYVKLUW7","schema_version":"1.0","canonical_sha256":"2e2aa5d2df0b0564c1c25bd0a517881443fa3aeedae5121b007b60d403abb63f","source":{"kind":"arxiv","id":"2311.09828","version":3},"attestation_state":"computed","paper":{"title":"AfriMTE and AfriCOMET: Enhancing COMET to Embrace Under-resourced African Languages","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.CL","authors_text":"Abdul-Hakeem Omotayo, Abeeb Afolabi, Andiswa Bukula, Anuoluwapo Aremu, Ayinde Hassan, Bernard Opoku, Chiamaka Chukwuneke, Chinedu Emmanuel Mbonu, Christine Mwase, Clemencia Siro, Daud Abolade, David Ifeoluwa Adelani, Eleftheria Briakou, Eric Muchiri, Foutse Yuehgoh, Hamam Mokayed, Iyanuoluwa Shode, Jessica Ojo, Jiayi Wang, Lama Alkhaled, Lolwethu Ndolela, Lyse Naomi Wamba Momo, Marek Masiak, Marine Carpuat, Millicent Ochieng, Muhidin Mohamed, Naome A. Etori, Nnaemeka Obiefuna, Oluwabusayo Olufunke Awoyomi, Onyekachi Raphael Ogbu, Oumaima Hourrane, Perez Ogayo, Pontus Stenetorp, Ricardo Rei, Ricky Macharm, Ruqayya Nasir Iro, Saheed S. Abdullahi, Sakayo Toadoum Sari, Salma El Anigri, Salomey Osei, Sam Brian, Samuel Njoroge, Sana Al-azzawi, Shafie Abdi Mohamed, Shamsuddeen Hassan Muhammad, Simbiat Ajao, Sofia Bourhim, Stephen E. Moore, Sweta Agrawal, Temitayo Olatoye, Thabiso Mangwana, Tosin Adewumi, Verrah Akinyi Otiende, Wangari Kimotho, Wangui Kimotho, Xuanli He, Yao Lu, Zainab Akinjobi","submitted_at":"2023-11-16T11:52:52Z","abstract_excerpt":"Despite the recent progress on scaling multilingual machine translation (MT) to several under-resourced African languages, accurately measuring this progress remains challenging, since evaluation is often performed on n-gram matching metrics such as BLEU, which typically show a weaker correlation with human judgments. Learned metrics such as COMET have higher correlation; however, the lack of evaluation data with human ratings for under-resourced languages, complexity of annotation guidelines like Multidimensional Quality Metrics (MQM), and limited language coverage of multilingual encoders ha"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2311.09828","kind":"arxiv","version":3},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2023-11-16T11:52:52Z","cross_cats_sorted":[],"title_canon_sha256":"75bb758c2acaab0d9cca46beedf696abea0e22482d8619c496100bb8c6d741a5","abstract_canon_sha256":"2cd09f705c331a43060487130940fbeec155a64f3332427d3226bc7a0068a60c"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T08:11:21.630775Z","signature_b64":"BewxyJIjGxr0SZA9RlhRi6CAYIUOUcztuzFTI0Jc2HPaXkaojR8nmoDnh+HoPNGsaCtiCO33xDLpyGSVSdGeBw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"2e2aa5d2df0b0564c1c25bd0a517881443fa3aeedae5121b007b60d403abb63f","last_reissued_at":"2026-07-05T08:11:21.630257Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T08:11:21.630257Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"AfriMTE and AfriCOMET: Enhancing COMET to Embrace Under-resourced African Languages","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.CL","authors_text":"Abdul-Hakeem Omotayo, Abeeb Afolabi, Andiswa Bukula, Anuoluwapo Aremu, Ayinde Hassan, Bernard Opoku, Chiamaka Chukwuneke, Chinedu Emmanuel Mbonu, Christine Mwase, Clemencia Siro, Daud Abolade, David Ifeoluwa Adelani, Eleftheria Briakou, Eric Muchiri, Foutse Yuehgoh, Hamam Mokayed, Iyanuoluwa Shode, Jessica Ojo, Jiayi Wang, Lama Alkhaled, Lolwethu Ndolela, Lyse Naomi Wamba Momo, Marek Masiak, Marine Carpuat, Millicent Ochieng, Muhidin Mohamed, Naome A. Etori, Nnaemeka Obiefuna, Oluwabusayo Olufunke Awoyomi, Onyekachi Raphael Ogbu, Oumaima Hourrane, Perez Ogayo, Pontus Stenetorp, Ricardo Rei, Ricky Macharm, Ruqayya Nasir Iro, Saheed S. Abdullahi, Sakayo Toadoum Sari, Salma El Anigri, Salomey Osei, Sam Brian, Samuel Njoroge, Sana Al-azzawi, Shafie Abdi Mohamed, Shamsuddeen Hassan Muhammad, Simbiat Ajao, Sofia Bourhim, Stephen E. Moore, Sweta Agrawal, Temitayo Olatoye, Thabiso Mangwana, Tosin Adewumi, Verrah Akinyi Otiende, Wangari Kimotho, Wangui Kimotho, Xuanli He, Yao Lu, Zainab Akinjobi","submitted_at":"2023-11-16T11:52:52Z","abstract_excerpt":"Despite the recent progress on scaling multilingual machine translation (MT) to several under-resourced African languages, accurately measuring this progress remains challenging, since evaluation is often performed on n-gram matching metrics such as BLEU, which typically show a weaker correlation with human judgments. Learned metrics such as COMET have higher correlation; however, the lack of evaluation data with human ratings for under-resourced languages, complexity of annotation guidelines like Multidimensional Quality Metrics (MQM), and limited language coverage of multilingual encoders ha"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2311.09828","kind":"arxiv","version":3},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2311.09828/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2311.09828","created_at":"2026-07-05T08:11:21.630324+00:00"},{"alias_kind":"arxiv_version","alias_value":"2311.09828v3","created_at":"2026-07-05T08:11:21.630324+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2311.09828","created_at":"2026-07-05T08:11:21.630324+00:00"},{"alias_kind":"pith_short_12","alias_value":"FYVKLUW7BMCW","created_at":"2026-07-05T08:11:21.630324+00:00"},{"alias_kind":"pith_short_16","alias_value":"FYVKLUW7BMCWJQOC","created_at":"2026-07-05T08:11:21.630324+00:00"},{"alias_kind":"pith_short_8","alias_value":"FYVKLUW7","created_at":"2026-07-05T08:11:21.630324+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2506.00507","citing_title":"Exploring In-context Example Generation for Machine Translation","ref_index":43,"is_internal_anchor":true}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/FYVKLUW7BMCWJQOCLPIKKF4ICR","json":"https://pith.science/pith/FYVKLUW7BMCWJQOCLPIKKF4ICR.json","graph_json":"https://pith.science/api/pith-number/FYVKLUW7BMCWJQOCLPIKKF4ICR/graph.json","events_json":"https://pith.science/api/pith-number/FYVKLUW7BMCWJQOCLPIKKF4ICR/events.json","paper":"https://pith.science/paper/FYVKLUW7"},"agent_actions":{"view_html":"https://pith.science/pith/FYVKLUW7BMCWJQOCLPIKKF4ICR","download_json":"https://pith.science/pith/FYVKLUW7BMCWJQOCLPIKKF4ICR.json","view_paper":"https://pith.science/paper/FYVKLUW7","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2311.09828&json=true","fetch_graph":"https://pith.science/api/pith-number/FYVKLUW7BMCWJQOCLPIKKF4ICR/graph.json","fetch_events":"https://pith.science/api/pith-number/FYVKLUW7BMCWJQOCLPIKKF4ICR/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/FYVKLUW7BMCWJQOCLPIKKF4ICR/action/timestamp_anchor","attest_storage":"https://pith.science/pith/FYVKLUW7BMCWJQOCLPIKKF4ICR/action/storage_attestation","attest_author":"https://pith.science/pith/FYVKLUW7BMCWJQOCLPIKKF4ICR/action/author_attestation","sign_citation":"https://pith.science/pith/FYVKLUW7BMCWJQOCLPIKKF4ICR/action/citation_signature","submit_replication":"https://pith.science/pith/FYVKLUW7BMCWJQOCLPIKKF4ICR/action/replication_record"}},"created_at":"2026-07-05T08:11:21.630324+00:00","updated_at":"2026-07-05T08:11:21.630324+00:00"}