{"as_of":"2026-08-12T08:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6acf09bebd77c22b080f85fdc75472d6bb0fe3d159bca4755356de81cffbb893","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:41:18.444887Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:30:56.562707Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T21:30:57.370850Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"cited_work":{"arxiv_id":"2412.03253","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03253","snapshot_observed_at":"2026-08-10T21:30:57.370850Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","venue":"cs.CL","work_id":"c35a936c-caf6-4af0-95a4-79746d03119f","year":2024},"citing_paper":{"arxiv_id":"2501.04662","last_updated":"2025-01-08T18:15:47Z","snapshot_observed_at":"2026-08-11T16:37:36.511638Z","submitted_at":"2025-01-08T18:15:47Z","title":"On The Origin of Cultural Biases in Language Models: From Pre-training Data to Linguistic Phenomena","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T21:30:56.562707Z"},"links":{"cited_paper":"/paper/2412.03253","citing_paper":"/paper/2501.04662"},"observation_digest":"sha256:2f480b5ad93c7f07226596b69fe1a518bf861539a5096e161408666cb02bc7f1","observation_id":"074f58ac-0044-438b-8488-0d311c603f78","resolution":{"observed_at":"2026-08-10T21:30:57.375574Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03253/citation-record","integrity":"/paper/2412.03253/integrity","json":"/paper/2412.03253/citation-record.json","paper":"/paper/2412.03253"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.336053Z","title":"Learning to summarize with human feedback","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.336053Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:75a2959dc9b5cc04124570979b75bace9f7cc874b9099be22ed815a5b5ed6685","observation_id":"d4fcfe96-f2d7-4773-ae84-0c0e4b35d467","resolution":{"observed_at":"2026-08-11T22:41:16.336053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.845668Z","title":"Acegpt, localizing large language models in arabic, 2024","venue":null,"work_id":"a0a462c0-990d-4eba-881a-141d46cb8b83","year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.385403Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:877233ed4a39bfbd831bcbcb3b812177440693ef8e92e73fd9da00b388a714fb","observation_id":"780423a1-fd20-4ffb-ac45-7a1967580944","resolution":{"observed_at":"2026-08-11T22:41:22.894747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.434749Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.434749Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:340893a80cb40209e6bcef2f42c2318d3bf3cd514045ebdc43830b2f89300f1f","observation_id":"287211c1-edd6-4edc-8d90-199cbdad0f13","resolution":{"observed_at":"2026-08-11T22:41:16.434749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-10T07:52:08.606999Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-11T22:41:16.457997Z","title":"Finetuned language models are zero-shot learners","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.457997Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:1aac2205d6f0d3cabb12a5d79843827ff9fd05113345b6c0494615b2490508fa","observation_id":"67a2410b-6080-48b4-a7fc-c4b4f33a61e7","resolution":{"observed_at":"2026-08-11T22:41:16.457997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.467179Z","title":"Lima: Less is more for alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.467179Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:60d92afb810a13fb5ba3443f3f23d4bf3cdc006bd94a356e97724be2687a1cdc","observation_id":"a0f492ce-83cd-4770-b9ff-e7897bdc692d","resolution":{"observed_at":"2026-08-11T22:41:16.467179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12219","last_updated":"2024-04-17T15:03:19Z","snapshot_observed_at":"2026-08-10T09:22:36.146578Z","submitted_at":"2024-02-19T15:21:58Z","title":"Reformatted Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12219","snapshot_observed_at":"2026-08-11T22:41:16.476238Z","title":"Reformatted alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.476238Z"},"links":{"cited_paper":"/paper/2402.12219","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:2c9299b661104841a0a08eed8fb7549ee71c5902649990b52f8e471772c74274","observation_id":"18248cac-772c-4a86-89e1-688ec83c3a18","resolution":{"observed_at":"2026-08-11T22:41:16.476238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-11T22:41:16.484024Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.484024Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:761e7ab9f5194de3368cfcaa12d20d2e6603b20936610b90953eb7c5816f7d55","observation_id":"84109a36-4e6b-49b7-b4cb-348fee6684b7","resolution":{"observed_at":"2026-08-11T22:41:16.484024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.510521Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.510521Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:50c88afe40c7cf1672de9bd6ac832cfe8e65bbf6d3caf83140d176bb83fc2726","observation_id":"48853b1b-8c90-4f0e-a433-09e2adf41e9d","resolution":{"observed_at":"2026-08-11T22:41:16.510521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.520941Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.520941Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:4ef3b55b2d1375f1d06e8059b7ad85ba61b8eebaaf43b66a29ce40db52e4dd28","observation_id":"53c0d10e-8673-4a7c-8c9c-d132fb8788a6","resolution":{"observed_at":"2026-08-11T22:41:16.520941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T22:41:16.530568Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.530568Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:026e546b56531f426a6be5a44ef20b0fc08961931d9c9e9ed59efc7e31884d8a","observation_id":"65ecf153-9e41-4475-94d3-8f2d5b9a4d41","resolution":{"observed_at":"2026-08-11T22:41:16.530568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.542808Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.542808Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:9744e8eb65ce564e48601f46cd245fa5afad6be092aeec4f4b67cd69e2389855","observation_id":"46778eab-5ed7-4681-a873-635f6d359030","resolution":{"observed_at":"2026-08-11T22:41:16.542808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.574784Z","title":"Rlaif: Scaling reinforcement learning from human feedback with ai feedback, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.574784Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:425dfe665d4f344b02e9940690af974724e7003874a505a8a30a78a6b9fba7c8","observation_id":"bbe2a39d-1070-4547-b869-85d4eb6ad6cc","resolution":{"observed_at":"2026-08-11T22:41:16.574784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-08-11T19:09:11.098841Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-11T22:41:16.599664Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.599664Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:088e1d9c64badeec4f90bbf8966161feffdfc164cd57303b54250f12b9658baf","observation_id":"272b5568-a605-4c1d-beba-12883454d05f","resolution":{"observed_at":"2026-08-11T22:41:16.599664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.624141Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.624141Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:3635ca9ce20061711b7c89bc095343dc67c8dc5744e4753fae34c4579694c457","observation_id":"4d7c3042-ce7c-41a2-887e-c04da6ebb9c0","resolution":{"observed_at":"2026-08-11T22:41:16.624141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.647135Z","title":"A study of practical deduplication","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.647135Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:024f3ff219aedf377d4de59939b7451110ed937944f74c98e884a844fb12972f","observation_id":"fdeb5a6b-eb99-4869-8a5c-92a45024cf9b","resolution":{"observed_at":"2026-08-11T22:41:16.647135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-08-09T05:10:26.091710Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-08-11T22:41:16.674895Z","title":"Real- toxicityprompts: Evaluating neural toxic degeneration in language models","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.674895Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:8d49a6432c6e16b7f406f5b3029cfd913145bfd12e8eacbb781c09e34d84ee75","observation_id":"9bd87c3f-8595-4b44-8a5d-af3857699207","resolution":{"observed_at":"2026-08-11T22:41:16.674895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09373","last_updated":"2024-08-10T02:27:57Z","snapshot_observed_at":"2026-07-06T18:14:46.143061Z","submitted_at":"2024-05-15T14:22:33Z","title":"PolygloToxicityPrompts: Multilingual Evaluation of Neural Toxic Degeneration in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09373","snapshot_observed_at":"2026-08-11T22:41:16.693382Z","title":"Polyglotoxicityprompts: Multilingual evaluation of neural toxic degeneration in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.693382Z"},"links":{"cited_paper":"/paper/2405.09373","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:8b19dd445855c37440caf52ab65a7fd29c807f8d2abb682d37349b3ce53a2ede","observation_id":"e5a7949d-2e8d-45a0-891b-f52913efb766","resolution":{"observed_at":"2026-08-11T22:41:16.693382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-11T22:16:24.062734Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-11T22:41:16.754752Z","title":"When less is more: Investigating data pruning for pretraining llms at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.754752Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:2ed506e9208bb8d0c8b25a0db84416487a5f1642cddbf6a264d71365742f7930","observation_id":"322b0f8c-f7b8-4d33-ae70-9b33a70e34cd","resolution":{"observed_at":"2026-08-11T22:41:16.754752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.782495Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.782495Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:14dc3080e8d2e3b085b474a6b9b8bf3abe4f6a43f285441fa87507043f5bff7b","observation_id":"6f609631-ccf4-468d-8c9b-dcdee3df629f","resolution":{"observed_at":"2026-08-11T22:41:16.782495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.647414Z","title":"Arabic natural language processing: Challenges and solutions","venue":null,"work_id":"890eb10b-4009-478b-a82e-4785f99c8fbd","year":2009},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.815267Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:88048f3fada58a440e4df734fb430247382ac73da928df06a2c8277e36da3f39","observation_id":"e09b43ff-2416-4fd9-a580-c45606f02c8a","resolution":{"observed_at":"2026-08-11T22:41:22.665143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.620621Z","title":"\"arabicmmlu: Assessing massive multitask language understanding in arabic","venue":null,"work_id":"e080f316-a8fa-4b6f-bb03-c0edfd2b84aa","year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.838549Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:f5d52f49fe47ee23a8387e7b7be7099a04c0b00f0eefd01adf798005381e7c4f","observation_id":"035c8103-3941-4491-b89d-45ecb828477f","resolution":{"observed_at":"2026-08-11T22:41:22.629977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.514752Z","title":"EXAMS: A multi-subject high school examinations dataset for cross-lingual and multilingual question answering","venue":null,"work_id":"0ae68556-f765-4c99-b8cd-e9482d52537c","year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.858504Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:ba2554ddc025b69b3a5427acfd359f4f9a19bdfc5683738168448b5d7fd71188","observation_id":"ae41c236-657a-48f0-ae57-ad8122861fab","resolution":{"observed_at":"2026-08-11T22:41:22.530308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09017","last_updated":"2024-11-05T02:19:26Z","snapshot_observed_at":"2026-08-11T06:30:24.207111Z","submitted_at":"2024-03-14T00:45:24Z","title":"AraTrust: An Evaluation of Trustworthiness for LLMs in Arabic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09017","snapshot_observed_at":"2026-08-11T22:41:16.871862Z","title":"Aratrust: An evaluation of trustworthiness for llms in arabic","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.871862Z"},"links":{"cited_paper":"/paper/2403.09017","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:69e0d9a8c0d410b6dd7b69fe05e98eb844c47d968f9168fa83bf4aa397c2432c","observation_id":"fb3ac2af-c3b6-4820-969e-5d6ae0889f3b","resolution":{"observed_at":"2026-08-11T22:41:16.871862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-11T22:41:16.883113Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.883113Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:0895338953e2ddfa6b7be146739985ba3026137a7d26746fe466250f6a1aef5c","observation_id":"2c444fcc-7eae-4be6-a34f-4b71af006b3a","resolution":{"observed_at":"2026-08-11T22:41:16.883113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.355157Z","title":"Jais and jais- chat: Arabic-centric foundation and instruction-tuned open generative large language models, 2023","venue":null,"work_id":"09f0047f-30df-43b9-843d-cbc8afe9132e","year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.891313Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:4b2fa467c18207cf29099aaa04bae1cf9fc7e29d366a1d4e359857c990fabf74","observation_id":"d4bb41ae-4fc2-420a-b7e1-0efea69d5089","resolution":{"observed_at":"2026-08-11T22:41:22.414760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.901062Z","title":"SlimPajama: A 627B token cleaned and deduplicated version of RedPajama","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.901062Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:453bab5276637afd20d249493d1e90017a0839c2c23fe1b9ff588d57dafa4403","observation_id":"eda54012-ac71-4c24-b49e-0c54ca12b6ec","resolution":{"observed_at":"2026-08-11T22:41:16.901062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:22.169545Z","title":"Chinese tiny llm: Pretraining a chinese-centric large language model, 2024","venue":null,"work_id":"5f9167ff-686a-47b5-9fca-012bf99e4485","year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.935409Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:26456ee2efd8150df34083bd3ad2165e286685d9c0b313aa94793e9e9a82a579","observation_id":"eb1ffae9-2875-408c-8fa6-a0ee2ce5619b","resolution":{"observed_at":"2026-08-11T22:41:22.191822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:16.966777Z","title":"Wikimedia downloads","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:16.966777Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:c1348c7f352fdd8a64e3c2e654d84ab612bc7b9f3202e1183685fe1f473d9c4a","observation_id":"ad3ba5bc-c6fa-431c-a46d-3f324ddb501a","resolution":{"observed_at":"2026-08-11T22:41:16.966777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.020213Z","title":"Jiang, Jia Deng, Stella Biderman, and Sean Welleck","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.020213Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:95f5cab6ac62e777a3d3d8b6f951f553301e321591a73ed4c4ea0497b1abab62","observation_id":"90bf52a3-0198-441e-821b-a62d5754e39b","resolution":{"observed_at":"2026-08-11T22:41:17.020213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.104941Z","title":"Alghamdi, Lian Zhang, Ruoyu Sun, Haizhou Li, Benyou Wang, and Jinchao Xu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.104941Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:2a34e0486f8e0432eedb96f2eb658748ee6dc97df3766a5d963ca5860ea17633","observation_id":"7054f4c6-32f3-439b-a76e-975448e9e2af","resolution":{"observed_at":"2026-08-11T22:41:17.104941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.165123Z","title":"Opencompass: A universal evaluation platform for foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.165123Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:1122ae4e4535412c40a571497e426e14d4fe243a4618fa9a6724e1cc9cb1c8f8","observation_id":"c9f314dc-007d-44b4-a7f3-ce430c7e7685","resolution":{"observed_at":"2026-08-11T22:41:17.165123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.201915Z","title":"Beavertails: Towards improved safety alignment of llm via a human-preference dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.201915Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:085f11d7bb9f128305b005bdb04caef96ee4c5e158e4f857bc69d4b67e2478e4","observation_id":"20c2ae4f-a03d-4de1-be23-63ba8c07e2cd","resolution":{"observed_at":"2026-08-11T22:41:17.201915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17926","last_updated":"2023-08-30T13:22:35Z","snapshot_observed_at":"2026-08-08T03:32:23.667881Z","submitted_at":"2023-05-29T07:41:03Z","title":"Large Language Models are not Fair Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17926","snapshot_observed_at":"2026-08-11T22:41:17.259546Z","title":"Large language models are not fair evaluators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.259546Z"},"links":{"cited_paper":"/paper/2305.17926","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:821975ba225678ccc2f7ebf2ec99373eeae9f48f3c8a7fde56204e81b11a432c","observation_id":"ed9c92a2-737c-44fe-9a4c-e5c72058eaad","resolution":{"observed_at":"2026-08-11T22:41:17.259546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01116","last_updated":"2023-06-01T20:03:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T20:03:56Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01116","snapshot_observed_at":"2026-08-11T22:41:17.292783Z","title":"The refinedweb dataset for falcon llm: outperforming curated corpora with web data, and web data only","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.292783Z"},"links":{"cited_paper":"/paper/2306.01116","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:87f8d1701004f7cc5f57fd4d9706754761d603a1245cfb7cd09951b5fe999779","observation_id":"f864a6fa-d962-4f3e-9dcd-d0b0151d779f","resolution":{"observed_at":"2026-08-11T22:41:17.292783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-08-10T21:55:43.802039Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-11T22:41:17.331131Z","title":"Textbooks are all you need","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.331131Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:2c069a57d4874428f9e7f53560148758779d41a9ab6b397007bf3016f046a109","observation_id":"6f003954-aa35-4eb1-99b8-0acc88be5a45","resolution":{"observed_at":"2026-08-11T22:41:17.331131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-11T22:41:17.353363Z","title":"Textbooks are all you need ii: phi-1.5 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.353363Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:388276804a7158e64ca1832988cfd5f2cc84ecf68a1bc0693f267f9648edcbe0","observation_id":"01ae4bbc-daa9-4e78-9e35-fcd22d04d4a5","resolution":{"observed_at":"2026-08-11T22:41:17.353363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.381487Z","title":"Phi-2: The surprising power of small language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.381487Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:33937f9910d1a384dee7ebe516cf8fa74352743f31ead5700fe32836ab159f62","observation_id":"4d3361bb-7ed3-4daf-9ef9-29348d1d9641","resolution":{"observed_at":"2026-08-11T22:41:17.381487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.749005Z","title":"Quality at a glance: An audit of web-crawled multilingual datasets","venue":null,"work_id":"2ff498b2-2fac-4e0e-8b9a-f2161160676f","year":2022},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.424562Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:b826955c90a51e909b55e67834e38ee59ba3bddc0137c85933e2b5ea8b40d2a7","observation_id":"478962b9-6511-452d-8d23-7be35ae18bc8","resolution":{"observed_at":"2026-08-11T22:41:21.784730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16380","last_updated":"2024-01-29T18:19:08Z","snapshot_observed_at":"2026-08-10T15:59:45.300276Z","submitted_at":"2024-01-29T18:19:08Z","title":"Rephrasing the Web: A Recipe for Compute and Data-Efficient Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16380","snapshot_observed_at":"2026-08-11T22:41:17.466195Z","title":"Rephrasing the web: A recipe for compute and data-efficient language modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.466195Z"},"links":{"cited_paper":"/paper/2401.16380","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:3484fe78b077704c4088ba1644e9e9f37277b882c2af164a1deae418d10f6648","observation_id":"9ffb7686-a2bd-458c-bdb3-12e24d32dfa9","resolution":{"observed_at":"2026-08-11T22:41:17.466195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.626787Z","title":"Preprocessing arabic text on social media","venue":null,"work_id":"e535ba33-766a-47f7-a4ba-10faee27cac8","year":2021},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.503229Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:fe6b115ef535e98b320b3913396eb6acded3c7a8074dd7a880cf3aca72fa05ba","observation_id":"3223159f-64da-4da2-877f-d7f6438de931","resolution":{"observed_at":"2026-08-11T22:41:21.668735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-11T22:41:17.551449Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.551449Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:18e1edad959278b87d09f13188388f6ee02137cfdab3f3a967c68c8ebffa8655","observation_id":"f894d4c1-6c47-4509-8cd5-9efff08edf49","resolution":{"observed_at":"2026-08-11T22:41:17.551449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00359","last_updated":"2019-11-15T00:03:54Z","snapshot_observed_at":"2026-07-06T08:34:04.911718Z","submitted_at":"2019-11-01T13:09:28Z","title":"CCNet: Extracting High Quality Monolingual Datasets from Web Crawl Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00359","snapshot_observed_at":"2026-08-11T22:41:17.596836Z","title":"Ccnet: Extracting high quality monolingual datasets from web crawl data","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.596836Z"},"links":{"cited_paper":"/paper/1911.00359","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:34ddabedae53dd031856052e1510139d861da40b911241fc3a2fda58aa2577ea","observation_id":"d5af562e-77c8-4ea8-b3c2-534c46e802fc","resolution":{"observed_at":"2026-08-11T22:41:17.596836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-11T22:41:17.677226Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.677226Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:0f6067f716d3239f9d3a280abe3be278deb0ce7fa2863cc2fff910cdb716e1c9","observation_id":"12ead447-8dcb-42ec-839e-2618ab6a0882","resolution":{"observed_at":"2026-08-11T22:41:17.677226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02416","last_updated":"2024-11-02T10:01:38Z","snapshot_observed_at":"2026-08-09T15:01:00.846487Z","submitted_at":"2024-02-04T09:24:51Z","title":"Aligner: Efficient Alignment by Learning to Correct","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02416","snapshot_observed_at":"2026-08-11T22:41:17.718726Z","title":"Aligner: Achieving efficient alignment through weak-to-strong correction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.718726Z"},"links":{"cited_paper":"/paper/2402.02416","citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:f9946422ed64807148830440b9f20aa85334446245f0d2ff3f53380982379318","observation_id":"07df9e27-759c-4048-be3c-26ded23721f2","resolution":{"observed_at":"2026-08-11T22:41:17.718726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:17.772248Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.772248Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:a7abdfd5e16844cd3c3efbd0471b3c6ac168ff22c9269f1a4b41c08b74f14c0f","observation_id":"195e61ae-67b5-4609-ac52-649fe2dc0bd3","resolution":{"observed_at":"2026-08-11T22:41:17.772248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.464740Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":"b4c2500c-b173-4fc3-b606-8fbf452c9a62","year":2020},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.791126Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:9c0771a2f7d8b79c36aaae03409e86c69eebcdf2ba79ded1403f81ad17b35ad2","observation_id":"811bc234-d5a3-4195-8198-a3db54964f74","resolution":{"observed_at":"2026-08-11T22:41:21.516847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.274735Z","title":null,"venue":null,"work_id":"49b26fa8-10d0-4f7d-b685-017442369e67","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.840532Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:7fac8245da5ceade08172fc069ff6828301f7124d618b5c20708032a00809f6e","observation_id":"5c1b27b9-22e1-410c-ace3-ad2b7048d7a8","resolution":{"observed_at":"2026-08-11T22:41:21.318285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.174799Z","title":null,"venue":null,"work_id":"3b322309-c68b-4ce5-85c8-d6ebdbc131b3","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.867547Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:0a4e9d8eb871e1f68cb0d4e746fcd3fd9f3c5511f2c31609343a437e5f435a3c","observation_id":"9b624a10-9385-4d04-a7ba-ef9816a0a7d5","resolution":{"observed_at":"2026-08-11T22:41:21.194857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:21.031370Z","title":null,"venue":null,"work_id":"6705ef08-a354-4e48-aa3b-9edf3cfb3b54","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.912949Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:72031699e42c257e218dc9803e45d064fc8e15af26577e755f9c78d5e93291ce","observation_id":"3f636cec-be43-4a9b-b744-a1f1690a2f03","resolution":{"observed_at":"2026-08-11T22:41:21.064807Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.974788Z","title":null,"venue":null,"work_id":"be430b37-4b8a-4db9-a230-f390bc8e0e80","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:17.950361Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:e3223a5ca1480f4dc73df9cbc894e2bd8dee2c5e010dfe94cd02bf5a6e25f699","observation_id":"46aa44ef-0751-41d3-ad1f-b8c9e7c10b34","resolution":{"observed_at":"2026-08-11T22:41:21.004738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.854734Z","title":null,"venue":null,"work_id":"92888a98-7844-453e-bc70-728115b0768a","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.005230Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:3be45a816b02a9d3a704d6afbfc62597b1f53535398ebf26f83e8e62cc0194c7","observation_id":"4bb14ce0-2f80-41d3-8f69-78003686697b","resolution":{"observed_at":"2026-08-11T22:41:20.896973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.747343Z","title":null,"venue":null,"work_id":"c9654edb-26e2-44f7-9edb-0c719c1f2abd","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.054745Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:ab657a560019a534b36ccdc0dc5891756ce144eb4d70825efd95ac15592dea77","observation_id":"1cd762a5-2912-4018-958c-98c15a7d8daa","resolution":{"observed_at":"2026-08-11T22:41:20.779644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.638722Z","title":null,"venue":null,"work_id":"eb31c481-adff-420d-ac55-ab416a96dfda","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.095158Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:f2fd214793fd46288d17defbbb4fb205f33452709a43dd3f80d21d5ff51a5409","observation_id":"dc5be2df-fcd5-426c-bc03-f4d9ef503281","resolution":{"observed_at":"2026-08-11T22:41:20.679651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.545932Z","title":"for example: ### Arabic text data rewriting Arabic text: á j JË éJ ËAÓ XP@ñ Ó © Ôg","venue":null,"work_id":"b02eb552-f6a0-4845-9e9f-7410f462da7a","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.143632Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:d03bf8311317002531539a54a47fe3d6b68ec592a667cc4c6fd80afb93c53ea4","observation_id":"ebda2b06-36b9-49fa-9ce7-1daa496d76d7","resolution":{"observed_at":"2026-08-11T22:41:20.566343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.391555Z","title":null,"venue":null,"work_id":"f530b701-7144-49ad-a139-12cd0d818d3d","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.194824Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:de8577f55ef4b507cea875fd16d84a2e056be0d0a05a56af09c3f7e1b1ef8c0a","observation_id":"58e573ee-fa3c-4c45-b153-0483ebfd7767","resolution":{"observed_at":"2026-08-11T22:41:20.444788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.325460Z","title":null,"venue":null,"work_id":"c2548097-3997-49a5-ad5e-f2a3113a1f69","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.246539Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:5e1717ec6094bd2ed1521ddac0e210b6d743c0f8e1b3e4dd08e20f9b868e83e9","observation_id":"a0e068e7-5aca-49e7-ad25-35ede5682b6a","resolution":{"observed_at":"2026-08-11T22:41:20.348391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.265544Z","title":null,"venue":null,"work_id":"1e87a592-d225-4eb3-9007-f797623ea360","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.279285Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:65eb0ccfd09005e883243cd611fe42e964803d62ad10715cbafc0010a02cf8a1","observation_id":"fd2af012-8e90-4ba3-b53f-38df13105d35","resolution":{"observed_at":"2026-08-11T22:41:20.282848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.151670Z","title":null,"venue":null,"work_id":"3e25b34c-e416-4c3b-a6c8-3cb753ffd0c7","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.287882Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:1099f92099eedbeb5f12485871d5bf274ddd950c3135e291a58ba21fe5ef5289","observation_id":"9a82d610-e926-4dca-a300-bf15e18ed3c4","resolution":{"observed_at":"2026-08-11T22:41:20.188812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:20.078296Z","title":"The variance and average of these experiments are reported as ‘random (x3)’","venue":null,"work_id":"f965206d-00ed-486a-84a3-970ae587d1dc","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.309438Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:4a169f142d32f255c39eceb18f9149116ea5adc8fcaa480d94f77a3cc4210b7d","observation_id":"c40fd97f-9cd7-449d-9bd4-64c101bddbac","resolution":{"observed_at":"2026-08-11T22:41:20.116115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:18.338439Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.338439Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:ee3acbbc443a26b27539893333a35142c0eee2319630e8c1f7b5450458c397ad","observation_id":"f3924b62-113b-477c-a621-81e1b24a1cb8","resolution":{"observed_at":"2026-08-11T22:41:18.338439Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:19.944899Z","title":null,"venue":null,"work_id":"56dd9547-c70c-4878-be02-bab14e89aefa","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.394003Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:7604239436a54ae1023587017422093d1ec96acc36fedc2a660b52e083f65f8b","observation_id":"7ce123e2-ef33-409e-8914-957aeb26beef","resolution":{"observed_at":"2026-08-11T22:41:20.004825Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:41:19.795760Z","title":null,"venue":null,"work_id":"9108ae43-1166-4edc-b13b-94532a61305b","year":null},"citing_paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T22:41:18.444887Z"},"links":{"citing_paper":"/paper/2412.03253"},"observation_digest":"sha256:45c9b4f361647b23b18ecc740cb7fb05924b807909c86238db3b73b507b953ff","observation_id":"5254a99b-733d-45e6-a3de-23f32313c46b","resolution":{"observed_at":"2026-08-11T22:41:19.851771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.03253","last_updated":"2024-12-04T11:52:03Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T22:34:08.947063Z","submitted_at":"2024-12-04T11:52:03Z","title":"Alignment at Pre-training! Towards Native Alignment for Arabic LLMs"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":3,"unresolved":48,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2412.03253."}