{"as_of":"2026-08-16T09:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:943ef4b460530318820ccdcdaf832f502e84cbec2d7bf8b3bb2b341756a7f918","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:41:18.444887Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:30:56.562707Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T21:30:57.370850Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"cited_work":{"arxiv_id":"2412.03253","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03253","snapshot_observed_at":"2026-08-10T21:30:57.370850Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","venue":"cs.CL","work_id":"c35a936c-caf6-4af0-95a4-79746d03119f","year":2024},"citing_paper":{"arxiv_id":"2501.04662","last_updated":"2025-01-08T18:15:47Z","snapshot_observed_at":"2026-08-14T08:10:01.712695Z","submitted_at":"2025-01-08T18:15:47Z","title":"On The Origin of Cultural Biases in Language Models: From Pre-training Data to Linguistic Phenomena","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T21:30:56.562707Z"},"links":{"cited_paper":"/paper/2412.03253","citing_paper":"/paper/2501.04662"},"observation_digest":"sha256:9be7d746dae23730c7dcd8855c815131ffd003e556a3ad5402f2dff81a6fc2d7","observation_id":"074f58ac-0044-438b-8488-0d311c603f78","resolution":{"observed_at":"2026-08-10T21:30:57.375574Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03253/citation-record","integrity":"/paper/2412.03253/integrity","json":"/paper/2412.03253/citation-record.json","paper":"/paper/2412.03253"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.336053Z","title":"Learning to summarize with human feedback","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.336053Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:ce3bc2b1d2ff2d4e8a59c5d37986553a012dfc9b2b603bbce4eef3673a456839","observation_id":"d4fcfe96-f2d7-4773-ae84-0c0e4b35d467","resolution":{"observed_at":"2026-08-11T22:41:16.336053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.845668Z","title":"Acegpt, localizing large language models in arabic, 2024","venue":null,"work_id":"a0a462c0-990d-4eba-881a-141d46cb8b83","year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.385403Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:c5c3cb312a68db89d67439b16c1a3f0f0e423193c8637f74ff470e55155821a2","observation_id":"780423a1-fd20-4ffb-ac45-7a1967580944","resolution":{"observed_at":"2026-08-11T22:41:22.894747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.434749Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.434749Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:8761d07567f985dd3b0350c4fecee78a58ee11630be07c06deff66c153d0f604","observation_id":"287211c1-edd6-4edc-8d90-199cbdad0f13","resolution":{"observed_at":"2026-08-11T22:41:16.434749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-14T06:11:14.515796Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-11T22:41:16.457997Z","title":"Finetuned language models are zero-shot learners","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.457997Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:f03256c5c5226666ed7185a137f3a23300853c2f7a7c9d801c021d80628389ec","observation_id":"67a2410b-6080-48b4-a7fc-c4b4f33a61e7","resolution":{"observed_at":"2026-08-11T22:41:16.457997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.467179Z","title":"Lima: Less is more for alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.467179Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:a45c203ac857a4a90dce5a9651c37b5d0523e00b15ef543edafee1bc1009e0c7","observation_id":"a0f492ce-83cd-4770-b9ff-e7897bdc692d","resolution":{"observed_at":"2026-08-11T22:41:16.467179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12219","last_updated":"2024-04-17T15:03:19Z","snapshot_observed_at":"2026-08-13T04:15:21.007871Z","submitted_at":"2024-02-19T15:21:58Z","title":"Reformatted Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12219","snapshot_observed_at":"2026-08-11T22:41:16.476238Z","title":"Reformatted alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.476238Z"},"links":{"cited_paper":"/paper/2402.12219","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:2961397a7033b0bb52bd176d5dbd76aebb753295dc3d10a951a2770f5b0ea370","observation_id":"18248cac-772c-4a86-89e1-688ec83c3a18","resolution":{"observed_at":"2026-08-11T22:41:16.476238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-11T22:41:16.484024Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.484024Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:f483447c1ce1363f4bca1fde17f9fa16485ed4673a34cd4b33efe930fffa736f","observation_id":"84109a36-4e6b-49b7-b4cb-348fee6684b7","resolution":{"observed_at":"2026-08-11T22:41:16.484024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.510521Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.510521Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:cebcb36fb0b96f60d6ccb59ef73fe8161a8c0b6fc42e0289456527568bb1d4ad","observation_id":"48853b1b-8c90-4f0e-a433-09e2adf41e9d","resolution":{"observed_at":"2026-08-11T22:41:16.510521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.520941Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.520941Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:659564b148b03570ada2eee77ace2d4abfb31e7dc5b3028c9857eeacfdcc3330","observation_id":"53c0d10e-8673-4a7c-8c9c-d132fb8788a6","resolution":{"observed_at":"2026-08-11T22:41:16.520941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T22:41:16.530568Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.530568Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:81351e272426ad1544f2f548b27ac815dda82faaf2b744318d4ad40acf804c02","observation_id":"65ecf153-9e41-4475-94d3-8f2d5b9a4d41","resolution":{"observed_at":"2026-08-11T22:41:16.530568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.542808Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.542808Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:3c9d8be91a1504652227a098d09cf5f82526b0105c5436be550e9640a0e2ddba","observation_id":"46778eab-5ed7-4681-a873-635f6d359030","resolution":{"observed_at":"2026-08-11T22:41:16.542808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.574784Z","title":"Rlaif: Scaling reinforcement learning from human feedback with ai feedback, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.574784Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:9bb0e6334e4b67ca1d27a7f256b63575fbbc5ca1ac0df8b38bd50aeae2f96a36","observation_id":"bbe2a39d-1070-4547-b869-85d4eb6ad6cc","resolution":{"observed_at":"2026-08-11T22:41:16.574784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-08-14T14:27:25.466650Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-11T22:41:16.599664Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.599664Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:ba325c39999e8eeb16bb858e31621c5473943363034a59297522cb12401a7de8","observation_id":"272b5568-a605-4c1d-beba-12883454d05f","resolution":{"observed_at":"2026-08-11T22:41:16.599664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.624141Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.624141Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:e1047f32336c0edabb9845c1d246a2bf4e98db3e0e82b970b05b750e6eb97b7a","observation_id":"4d7c3042-ce7c-41a2-887e-c04da6ebb9c0","resolution":{"observed_at":"2026-08-11T22:41:16.624141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.647135Z","title":"A study of practical deduplication","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.647135Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:2eafc73b59bff956837ddb08e2ba98701c8a7d8306a356eb7a67c57867e411b4","observation_id":"fdeb5a6b-eb99-4869-8a5c-92a45024cf9b","resolution":{"observed_at":"2026-08-11T22:41:16.647135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-08-09T05:10:26.091710Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-08-11T22:41:16.674895Z","title":"Real- toxicityprompts: Evaluating neural toxic degeneration in language models","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.674895Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:aece170b3b6cdc4b9115a0e50fc9a35e7712e1f20ba0418252b03691fa57ef3e","observation_id":"9bd87c3f-8595-4b44-8a5d-af3857699207","resolution":{"observed_at":"2026-08-11T22:41:16.674895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09373","last_updated":"2024-08-10T02:27:57Z","snapshot_observed_at":"2026-08-13T00:07:10.505709Z","submitted_at":"2024-05-15T14:22:33Z","title":"PolygloToxicityPrompts: Multilingual Evaluation of Neural Toxic Degeneration in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09373","snapshot_observed_at":"2026-08-11T22:41:16.693382Z","title":"Polyglotoxicityprompts: Multilingual evaluation of neural toxic degeneration in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.693382Z"},"links":{"cited_paper":"/paper/2405.09373","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:2ca8776be51628b9f644f28d0d0a4c72ae0497185ef2c3016a51033288ae3272","observation_id":"e5a7949d-2e8d-45a0-891b-f52913efb766","resolution":{"observed_at":"2026-08-11T22:41:16.693382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-13T10:17:41.024765Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-11T22:41:16.754752Z","title":"When less is more: Investigating data pruning for pretraining llms at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.754752Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:ddf022133c8b9bf09a4214dcc429ec41edf65e743f53d698c4b825317e174f7e","observation_id":"322b0f8c-f7b8-4d33-ae70-9b33a70e34cd","resolution":{"observed_at":"2026-08-11T22:41:16.754752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.782495Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.782495Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:c5222d58e781b8fb5bc8d5a3a7dc372f89854fcbed3b45ec171360251ba89fac","observation_id":"6f609631-ccf4-468d-8c9b-dcdee3df629f","resolution":{"observed_at":"2026-08-11T22:41:16.782495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.647414Z","title":"Arabic natural language processing: Challenges and solutions","venue":null,"work_id":"890eb10b-4009-478b-a82e-4785f99c8fbd","year":2009},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.815267Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:f27889fcf9d7edb908d5b0e10d874eb80aa8e137964fe052b746aae1947b1f48","observation_id":"e09b43ff-2416-4fd9-a580-c45606f02c8a","resolution":{"observed_at":"2026-08-11T22:41:22.665143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.620621Z","title":"\"arabicmmlu: Assessing massive multitask language understanding in arabic","venue":null,"work_id":"e080f316-a8fa-4b6f-bb03-c0edfd2b84aa","year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.838549Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:29152b0fb85cc5c9a040827dbeb7ae3f04a3b653133cbe4c277e8fd66998c260","observation_id":"035c8103-3941-4491-b89d-45ecb828477f","resolution":{"observed_at":"2026-08-11T22:41:22.629977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.514752Z","title":"EXAMS: A multi-subject high school examinations dataset for cross-lingual and multilingual question answering","venue":null,"work_id":"0ae68556-f765-4c99-b8cd-e9482d52537c","year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.858504Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:323f9ce3c5c57d97891963ac7d842b6efc92dad6286db0a8dceda3396a8875d4","observation_id":"ae41c236-657a-48f0-ae57-ad8122861fab","resolution":{"observed_at":"2026-08-11T22:41:22.530308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09017","last_updated":"2024-11-05T02:19:26Z","snapshot_observed_at":"2026-08-13T14:51:29.304005Z","submitted_at":"2024-03-14T00:45:24Z","title":"AraTrust: An Evaluation of Trustworthiness for LLMs in Arabic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09017","snapshot_observed_at":"2026-08-11T22:41:16.871862Z","title":"Aratrust: An evaluation of trustworthiness for llms in arabic","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.871862Z"},"links":{"cited_paper":"/paper/2403.09017","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:9832aef0ec71057a5c25007fbee5ae3f0a3962c28173c4bfc7c3ae64e3c814d5","observation_id":"fb3ac2af-c3b6-4820-969e-5d6ae0889f3b","resolution":{"observed_at":"2026-08-11T22:41:16.871862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-11T22:41:16.883113Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.883113Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:ca79318801e9ebb01eed4cfca7312f00c39b08f32639a88d5d3ad4e41bd9208b","observation_id":"2c444fcc-7eae-4be6-a34f-4b71af006b3a","resolution":{"observed_at":"2026-08-11T22:41:16.883113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.355157Z","title":"Jais and jais- chat: Arabic-centric foundation and instruction-tuned open generative large language models, 2023","venue":null,"work_id":"09f0047f-30df-43b9-843d-cbc8afe9132e","year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.891313Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:3d3dd5013b54cdcd693e4cf7977aba5f86718fab98ed3dc5b1a1f20ac06dddee","observation_id":"d4bb41ae-4fc2-420a-b7e1-0efea69d5089","resolution":{"observed_at":"2026-08-11T22:41:22.414760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.901062Z","title":"SlimPajama: A 627B token cleaned and deduplicated version of RedPajama","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.901062Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:924665e4a16661e64bbb9385910d385e697260312ee06702a69aaccc5e0c6875","observation_id":"eda54012-ac71-4c24-b49e-0c54ca12b6ec","resolution":{"observed_at":"2026-08-11T22:41:16.901062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.169545Z","title":"Chinese tiny llm: Pretraining a chinese-centric large language model, 2024","venue":null,"work_id":"5f9167ff-686a-47b5-9fca-012bf99e4485","year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.935409Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:cbb4c44dc01a6dbe9103ac86edf1db8a3ade3be57030d6df17a8c394dc9889f4","observation_id":"eb1ffae9-2875-408c-8fa6-a0ee2ce5619b","resolution":{"observed_at":"2026-08-11T22:41:22.191822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.966777Z","title":"Wikimedia downloads","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.966777Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:a87e58795ac3fabbc195d2c846636d5d5c2fdb065ee2645c6382f26d53e70537","observation_id":"ad3ba5bc-c6fa-431c-a46d-3f324ddb501a","resolution":{"observed_at":"2026-08-11T22:41:16.966777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.020213Z","title":"Jiang, Jia Deng, Stella Biderman, and Sean Welleck","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.020213Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:364fcc4901c16fe2a68c032ad75c314461dc64c6ed2cb006ec17b2b1eff31772","observation_id":"90bf52a3-0198-441e-821b-a62d5754e39b","resolution":{"observed_at":"2026-08-11T22:41:17.020213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.104941Z","title":"Alghamdi, Lian Zhang, Ruoyu Sun, Haizhou Li, Benyou Wang, and Jinchao Xu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.104941Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:025db12eafb0162b14bf1f8928c9cc9e047d2e938eec48377c5625f87af4f44b","observation_id":"7054f4c6-32f3-439b-a76e-975448e9e2af","resolution":{"observed_at":"2026-08-11T22:41:17.104941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.165123Z","title":"Opencompass: A universal evaluation platform for foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.165123Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:3fff86f0db125a4c33e8ad2bf9de4e5bee22d39040c58e4b93c93e286093dc0b","observation_id":"c9f314dc-007d-44b4-a7f3-ce430c7e7685","resolution":{"observed_at":"2026-08-11T22:41:17.165123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.201915Z","title":"Beavertails: Towards improved safety alignment of llm via a human-preference dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.201915Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:f664731e763852d9f24a97c3c7e2537ea91d4887df6614296670c20674e8af92","observation_id":"20c2ae4f-a03d-4de1-be23-63ba8c07e2cd","resolution":{"observed_at":"2026-08-11T22:41:17.201915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17926","last_updated":"2023-08-30T13:22:35Z","snapshot_observed_at":"2026-08-14T09:51:03.197404Z","submitted_at":"2023-05-29T07:41:03Z","title":"Large Language Models are not Fair Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17926","snapshot_observed_at":"2026-08-11T22:41:17.259546Z","title":"Large language models are not fair evaluators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.259546Z"},"links":{"cited_paper":"/paper/2305.17926","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:3a8483b2a722e96c480bf21bdd4b93bce8ec0e78397588ed64551867119d716b","observation_id":"ed9c92a2-737c-44fe-9a4c-e5c72058eaad","resolution":{"observed_at":"2026-08-11T22:41:17.259546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01116","last_updated":"2023-06-01T20:03:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T20:03:56Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01116","snapshot_observed_at":"2026-08-11T22:41:17.292783Z","title":"The refinedweb dataset for falcon llm: outperforming curated corpora with web data, and web data only","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.292783Z"},"links":{"cited_paper":"/paper/2306.01116","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:a4e60634bcefe115760c4ececee27be7360ad6a5a7af7cbec1f818ea1dd527dc","observation_id":"f864a6fa-d962-4f3e-9dcd-d0b0151d779f","resolution":{"observed_at":"2026-08-11T22:41:17.292783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-08-13T11:19:55.436754Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-11T22:41:17.331131Z","title":"Textbooks are all you need","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.331131Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:3a82cc56d7486c47f1644514f6b2270dd944252e92e763e96908621ede6d96fa","observation_id":"6f003954-aa35-4eb1-99b8-0acc88be5a45","resolution":{"observed_at":"2026-08-11T22:41:17.331131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-11T22:41:17.353363Z","title":"Textbooks are all you need ii: phi-1.5 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.353363Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:5d34c479436506e3b2e7967d3775a4ccf78deb2cd8f6252f4b760a80dbe19600","observation_id":"01ae4bbc-daa9-4e78-9e35-fcd22d04d4a5","resolution":{"observed_at":"2026-08-11T22:41:17.353363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.381487Z","title":"Phi-2: The surprising power of small language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.381487Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:5e15e485da0f97333304dfbed673cfd608f95390c9cc36e949d3fce0260a6f13","observation_id":"4d3361bb-7ed3-4daf-9ef9-29348d1d9641","resolution":{"observed_at":"2026-08-11T22:41:17.381487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.749005Z","title":"Quality at a glance: An audit of web-crawled multilingual datasets","venue":null,"work_id":"2ff498b2-2fac-4e0e-8b9a-f2161160676f","year":2022},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.424562Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:73e61e3a848a0b3d4e85af36bb10baef1d27464fe39b2f497a2ae7233ef0460b","observation_id":"478962b9-6511-452d-8d23-7be35ae18bc8","resolution":{"observed_at":"2026-08-11T22:41:21.784730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16380","last_updated":"2024-01-29T18:19:08Z","snapshot_observed_at":"2026-08-13T04:32:26.957409Z","submitted_at":"2024-01-29T18:19:08Z","title":"Rephrasing the Web: A Recipe for Compute and Data-Efficient Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16380","snapshot_observed_at":"2026-08-11T22:41:17.466195Z","title":"Rephrasing the web: A recipe for compute and data-efficient language modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.466195Z"},"links":{"cited_paper":"/paper/2401.16380","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:d00ef0a78f200865bce476a046ead729b16a92624063f0fa2193203eae4c1547","observation_id":"9ffb7686-a2bd-458c-bdb3-12e24d32dfa9","resolution":{"observed_at":"2026-08-11T22:41:17.466195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.626787Z","title":"Preprocessing arabic text on social media","venue":null,"work_id":"e535ba33-766a-47f7-a4ba-10faee27cac8","year":2021},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.503229Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:5dac7fd18335f4b20acf97283c0a545180e2b8c7c47363294d145ec4a4ca002c","observation_id":"3223159f-64da-4da2-877f-d7f6438de931","resolution":{"observed_at":"2026-08-11T22:41:21.668735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-11T22:41:17.551449Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.551449Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:66c319fe0b46a419c96e8c0f3c24d2b9afb030304a9a655120b807707c11a351","observation_id":"f894d4c1-6c47-4509-8cd5-9efff08edf49","resolution":{"observed_at":"2026-08-11T22:41:17.551449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00359","last_updated":"2019-11-15T00:03:54Z","snapshot_observed_at":"2026-07-06T08:34:04.911718Z","submitted_at":"2019-11-01T13:09:28Z","title":"CCNet: Extracting High Quality Monolingual Datasets from Web Crawl Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00359","snapshot_observed_at":"2026-08-11T22:41:17.596836Z","title":"Ccnet: Extracting high quality monolingual datasets from web crawl data","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.596836Z"},"links":{"cited_paper":"/paper/1911.00359","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:2cd1aaa5d44129b20d2ab1dc1603171797b314e0b0203a015acb1da929c70822","observation_id":"d5af562e-77c8-4ea8-b3c2-534c46e802fc","resolution":{"observed_at":"2026-08-11T22:41:17.596836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-11T22:41:17.677226Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.677226Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:4f69409ccade914aa506e88e83d80b6945e3ac48bada80ee8e85136c23956be1","observation_id":"12ead447-8dcb-42ec-839e-2618ab6a0882","resolution":{"observed_at":"2026-08-11T22:41:17.677226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02416","last_updated":"2024-11-02T10:01:38Z","snapshot_observed_at":"2026-08-14T08:46:25.186464Z","submitted_at":"2024-02-04T09:24:51Z","title":"Aligner: Efficient Alignment by Learning to Correct","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02416","snapshot_observed_at":"2026-08-11T22:41:17.718726Z","title":"Aligner: Achieving efficient alignment through weak-to-strong correction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.718726Z"},"links":{"cited_paper":"/paper/2402.02416","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:80435ffebb35b8b1d7a0fac77265eb4d77039d61b7278f3ed67f498317d17d11","observation_id":"07df9e27-759c-4048-be3c-26ded23721f2","resolution":{"observed_at":"2026-08-11T22:41:17.718726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.772248Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.772248Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:8fbc0c6301e3f80ec7548acef9a224572ebc1512e318e394850616c9ad100c7c","observation_id":"195e61ae-67b5-4609-ac52-649fe2dc0bd3","resolution":{"observed_at":"2026-08-11T22:41:17.772248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.464740Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":"b4c2500c-b173-4fc3-b606-8fbf452c9a62","year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.791126Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:38eaeace3886760cba748203556b6bc460390acda0de8917d965ea3efdeb658a","observation_id":"811bc234-d5a3-4195-8198-a3db54964f74","resolution":{"observed_at":"2026-08-11T22:41:21.516847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.274735Z","title":null,"venue":null,"work_id":"49b26fa8-10d0-4f7d-b685-017442369e67","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.840532Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:df9274e639bf8ff5b880d58bd1028f01e2cee40747170f4f8b3eb6c585467f81","observation_id":"5c1b27b9-22e1-410c-ace3-ad2b7048d7a8","resolution":{"observed_at":"2026-08-11T22:41:21.318285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.174799Z","title":null,"venue":null,"work_id":"3b322309-c68b-4ce5-85c8-d6ebdbc131b3","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.867547Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:28e4c07bb92f5d8e62c8a30239af7c13eb51d8d2fcdbdd240f15f5246f299b62","observation_id":"9b624a10-9385-4d04-a7ba-ef9816a0a7d5","resolution":{"observed_at":"2026-08-11T22:41:21.194857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.031370Z","title":null,"venue":null,"work_id":"6705ef08-a354-4e48-aa3b-9edf3cfb3b54","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.912949Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:ae6560c8ef0f5788e16bd4bb2576bcbf93dc4bb8a45aa4ecb8f729957e5736f1","observation_id":"3f636cec-be43-4a9b-b744-a1f1690a2f03","resolution":{"observed_at":"2026-08-11T22:41:21.064807Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.974788Z","title":null,"venue":null,"work_id":"be430b37-4b8a-4db9-a230-f390bc8e0e80","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.950361Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:17fe3656d5380aee17826d8e48ac910b109178b84e74c6f655350bde671ad010","observation_id":"46aa44ef-0751-41d3-ad1f-b8c9e7c10b34","resolution":{"observed_at":"2026-08-11T22:41:21.004738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.854734Z","title":null,"venue":null,"work_id":"92888a98-7844-453e-bc70-728115b0768a","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.005230Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:10a25b830d1f3d148533049a6f2a1976c4c0dbf4b67540a053c389f79ba1ca52","observation_id":"4bb14ce0-2f80-41d3-8f69-78003686697b","resolution":{"observed_at":"2026-08-11T22:41:20.896973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.747343Z","title":null,"venue":null,"work_id":"c9654edb-26e2-44f7-9edb-0c719c1f2abd","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.054745Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:8ad39d6ec1dc44ddbff199b92e3490b4f927ba3ad8d6edb2dca942fc44c83b30","observation_id":"1cd762a5-2912-4018-958c-98c15a7d8daa","resolution":{"observed_at":"2026-08-11T22:41:20.779644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.638722Z","title":null,"venue":null,"work_id":"eb31c481-adff-420d-ac55-ab416a96dfda","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.095158Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:be749ec97a277e395a2d97d4e6f42f808a68022d872dae9faa97288d81fd6bf2","observation_id":"dc5be2df-fcd5-426c-bc03-f4d9ef503281","resolution":{"observed_at":"2026-08-11T22:41:20.679651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.545932Z","title":"for example: ### Arabic text data rewriting Arabic text: á j JË éJ ËAÓ XP@ñ Ó © Ôg","venue":null,"work_id":"b02eb552-f6a0-4845-9e9f-7410f462da7a","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.143632Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:ee1273eb5247d7014412d25c519e92e1f964e42d88670ef2108acf6af3b9a523","observation_id":"ebda2b06-36b9-49fa-9ce7-1daa496d76d7","resolution":{"observed_at":"2026-08-11T22:41:20.566343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.391555Z","title":null,"venue":null,"work_id":"f530b701-7144-49ad-a139-12cd0d818d3d","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.194824Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:da2609356a2a5a310571085253f2d63fd5f2a4a33332205ab3dfee6605c567bd","observation_id":"58e573ee-fa3c-4c45-b153-0483ebfd7767","resolution":{"observed_at":"2026-08-11T22:41:20.444788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.325460Z","title":null,"venue":null,"work_id":"c2548097-3997-49a5-ad5e-f2a3113a1f69","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.246539Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:45348491d91ef2492a84bcf7ca653f6e0ba514fe378634ce5b4aa121b83d943b","observation_id":"a0e068e7-5aca-49e7-ad25-35ede5682b6a","resolution":{"observed_at":"2026-08-11T22:41:20.348391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.265544Z","title":null,"venue":null,"work_id":"1e87a592-d225-4eb3-9007-f797623ea360","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.279285Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:223e089ac516996b29af9569f419cf1e3248f777df9891951106af6f616ba143","observation_id":"fd2af012-8e90-4ba3-b53f-38df13105d35","resolution":{"observed_at":"2026-08-11T22:41:20.282848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.151670Z","title":null,"venue":null,"work_id":"3e25b34c-e416-4c3b-a6c8-3cb753ffd0c7","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.287882Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:b5a7bd6a3bb4718e17ceae8bd612365148a890a12d15cf88d212927daf93bc4f","observation_id":"9a82d610-e926-4dca-a300-bf15e18ed3c4","resolution":{"observed_at":"2026-08-11T22:41:20.188812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.078296Z","title":"The variance and average of these experiments are reported as ‘random (x3)’","venue":null,"work_id":"f965206d-00ed-486a-84a3-970ae587d1dc","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.309438Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:7b78dc0ff1ecf85a4669daad6b236c72834e67c73b6546ac5f9a36eb054d029e","observation_id":"c40fd97f-9cd7-449d-9bd4-64c101bddbac","resolution":{"observed_at":"2026-08-11T22:41:20.116115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:18.338439Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.338439Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:70b0c3f3a3eeaf60692ae7ac59ff460356a73b4e54c15597c74e0ea8f1414705","observation_id":"f3924b62-113b-477c-a621-81e1b24a1cb8","resolution":{"observed_at":"2026-08-11T22:41:18.338439Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:19.944899Z","title":null,"venue":null,"work_id":"56dd9547-c70c-4878-be02-bab14e89aefa","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.394003Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:6a3143ccc47513d0d1903577f99bd9ed2ef478b9ab05f59334698a2e49054978","observation_id":"7ce123e2-ef33-409e-8914-957aeb26beef","resolution":{"observed_at":"2026-08-11T22:41:20.004825Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:19.795760Z","title":null,"venue":null,"work_id":"9108ae43-1166-4edc-b13b-94532a61305b","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.444887Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:f8de5c4d0b30f803bae060c493a823f2d1749409487d331212d609ebbf31b33a","observation_id":"5254a99b-733d-45e6-a3de-23f32313c46b","resolution":{"observed_at":"2026-08-11T22:41:19.851771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T04:29:24.294498Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":3,"unresolved":48,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2412.03253."}