{"as_of":"2026-08-08T08:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d448072c84182bc115d2708fa75657ca8bec3e109bae4767553b2722d52ab30f","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:31:20.747562Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T09:37:05.659296Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02280","snapshot_observed_at":"2026-08-03T09:37:05.659296Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.13346","last_updated":"2026-06-10T18:20:09Z","snapshot_observed_at":"2026-08-07T01:47:53.149339Z","submitted_at":"2026-01-19T19:30:35Z","title":"AfroScope: A Framework for Studying the Linguistic Landscape of Africa","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T09:37:05.659296Z"},"links":{"cited_paper":"/paper/2506.02280","citing_paper":"/paper/2601.13346"},"observation_digest":"sha256:79313b1c38c106d6e3261c6bb858d14e30e0bfa54bc941ce5d5bbd17510a0749","observation_id":"7d8b5202-beec-4f59-9557-28f4fc1c0040","resolution":{"observed_at":"2026-08-03T09:37:05.659296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02280/citation-record","integrity":"/paper/2506.02280/integrity","json":"/paper/2506.02280/citation-record.json","paper":"/paper/2506.02280"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:16.567115Z","title":"Masakhaner: Named entity recognition for african languages","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.567115Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:bffa2d56e9b2004d547318fe07b9fa6a888f20979f3376d05a67f5ac1244fa89","observation_id":"24af49ee-07cb-4fb2-a3ce-52da0a2f089d","resolution":{"observed_at":"2026-08-07T11:31:16.567115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.500564Z","title":"Alabi, David Ifeoluwa Adelani, Marius Mosbach, and Dietrich Klakow","venue":null,"work_id":"47c64ee1-f1d9-4188-8bf8-a3eb12301385","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.688013Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:e726408830f25afac475b48703d64a7122b7c72afbb9233d3dc277851f57328d","observation_id":"8a87328d-07dd-4ac8-b3d0-0c9ca832541a","resolution":{"observed_at":"2026-08-07T11:31:21.506806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.482902Z","title":"A ra BERT : Transformer-based model for A rabic language understanding","venue":null,"work_id":"0da1fb8c-0c03-4abd-8adb-b7caa5626df3","year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.796462Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:238fca08738e469e756f9e3779058f987320418413f6292056f4661b8c995f28","observation_id":"849748bf-50e9-45db-8b50-0b4f8d56c12b","resolution":{"observed_at":"2026-08-07T11:31:21.488624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.467166Z","title":"A ra GPT 2: Pre-trained transformer for A rabic language generation","venue":null,"work_id":"2726f7ed-8ab2-4e96-989f-59c7e17e8e1f","year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.871105Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:af1204bbb4597a77dd9db6e93ff68ac0ab1c5d90a2337e67e768a0d4bb3ca2b6","observation_id":"56e5ad4d-bf7b-4775-a034-46aa193ca82c","resolution":{"observed_at":"2026-08-07T11:31:21.472376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.449749Z","title":"The world's writing systems, 2024","venue":null,"work_id":"baa2129a-08ae-4646-8034-9cd07b7e8050","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:16.957053Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:696638601abd4b7ed5e1fe207643592c42b18f45956aa08ff499719482cac6c5","observation_id":"759a55e5-1421-44df-baba-e9b58fe31695","resolution":{"observed_at":"2026-08-07T11:31:21.455385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.062830Z","title":"Clark, Dan Garrette, Iulia Turc, and John Wieting","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.062830Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:e024ad5e1d6814f1b90f43eff3ea17b03689812b2907b0d018a9a78122b04671","observation_id":"87ff6b22-cb72-4a9c-9043-5d58e5d84754","resolution":{"observed_at":"2026-08-07T11:31:17.062830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.131375Z","title":"Unsupervised cross-lingual representation learning at scale","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.131375Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:6b25fb72828bcc3e21af1a6d42487655775c4a037794966c9871a67e4b02d613","observation_id":"1f98785a-7b38-4aa3-9011-bfd5cb1f34a7","resolution":{"observed_at":"2026-08-07T11:31:17.131375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.432931Z","title":"Costa-jussà, James Cross, Onur Çelebi, Maha Elbayad, Kenneth Heafield, Yan He, Elahe Kalbassi, Linlu Wang, Long Wang, Shuo Zhang, Angela Fan, et al","venue":null,"work_id":"0d547cf9-2b81-4d7b-82e3-4bf6df8a0884","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.199590Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:c88c1af5bb43bff2da4caba78f7c98a04dff3c41f478169ac81b6105ce7beb1a","observation_id":"3d40d5b4-26a0-4cfa-8130-cde6496f70a0","resolution":{"observed_at":"2026-08-07T11:31:21.438752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.275503Z","title":"I ndic BART : A pre-trained model for indic natural language generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.275503Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:f1be1c3348285ee9130d0d89d62fe834b931d2a90359d2825b98b0101dc315b2","observation_id":"8b865532-6f80-4e4b-b15a-31060f38b0eb","resolution":{"observed_at":"2026-08-07T11:31:17.275503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.416755Z","title":"Dai, Jonathan H","venue":null,"work_id":"e8e3c4fd-9b0d-4b65-ad67-ca1bf997dd82","year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.353562Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:c52192d94bdc3ef9da7661adb102f61e208a1eb42fe2fee8587bb1bf2d6d0bc7","observation_id":"eb06d123-76e1-4b6e-b83b-793b9f6b5225","resolution":{"observed_at":"2026-08-07T11:31:21.421435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T11:31:17.454634Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.454634Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:7b67da54ac25eaac5028e1a338a45544169728d2753b0dcd9a1c99bae38a83bb","observation_id":"85b361e1-b103-4b4d-8535-7750762f7468","resolution":{"observed_at":"2026-08-07T11:31:17.454634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.536207Z","title":"BERT : Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.536207Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:a55cded2c8b21fb57a0bcaabe5c088eb20f80b0a7832b6f90ade4f3af53a6ca4","observation_id":"f4977833-cb77-4775-ae8b-d4f83a108af5","resolution":{"observed_at":"2026-08-07T11:31:17.536207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.635908Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.635908Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:9145ada11c565fabe3504c8e59d79730becfa448b960263012acead0593ec8f5","observation_id":"cab97324-99d7-4dad-ba90-b3e0143a9d3a","resolution":{"observed_at":"2026-08-07T11:31:17.635908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.380478Z","title":null,"venue":null,"work_id":"932b933a-7762-4371-8c0d-b3c1c7ed398d","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.704637Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:bca53d3c2dd81b2572e200fcb233fe78d5f9ed9928c0e756daf4c3fbbabc819d","observation_id":"8d6450d8-c029-4405-8f80-92052358a36f","resolution":{"observed_at":"2026-08-07T11:31:21.385179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.364262Z","title":"Ethnologue: Languages of the world, 2025","venue":null,"work_id":"82dffb75-3277-494e-bce0-4d0668827903","year":2025},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.751526Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:2d7f3c24a1e637e00dfe16bd1984cd97c55ee9fa7afc71c180bcf1a0973b3fe9","observation_id":"ffda6658-4dcf-41ad-b70c-21fb7216e327","resolution":{"observed_at":"2026-08-07T11:31:21.369840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.822580Z","title":"Language-agnostic BERT sentence embedding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.822580Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:0ce68eff78fedd2481966252d66c1def24288c169b42d6c8048a9b0541ea9ddf","observation_id":"6382c1fd-89f1-4912-abc1-f26cdb4af5a1","resolution":{"observed_at":"2026-08-07T11:31:17.822580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:17.940518Z","title":"Guerreiro, Duarte M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:17.940518Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:4a5de2676fdfadbf4df4aba866fcb190d425576ceb6a001ee264ca02ca3a2f35","observation_id":"1adfb3d7-6e25-4993-8e7e-8ab058755d73","resolution":{"observed_at":"2026-08-07T11:31:17.940518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T11:31:18.023742Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.023742Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:3b47d62f0ee0dd503cfbd48aa441957c1e81ec43ac3d9cbc5776137f6200c4f2","observation_id":"8c54d4ca-0db1-48a4-acb5-c7226d8de970","resolution":{"observed_at":"2026-08-07T11:31:18.023742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.122121Z","title":"Glot500: Scaling multilingual corpora and language models to 500 languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.122121Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:99a4142f0d1d7a45556c606681988170f1d509443a8b3467948ff5478c0d08a1","observation_id":"7d5310d6-1dca-4b94-b880-517890fd6eb8","resolution":{"observed_at":"2026-08-07T11:31:18.122121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.192540Z","title":"A fri T e VA : Extending ?small data? pretraining approaches to sequence-to-sequence models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.192540Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:e703c93a3dd444190892e552d8c90f9041d77f090f7efe6359b4e11dadacaa08","observation_id":"cf224bba-82b6-41a1-8ed4-868b53209f75","resolution":{"observed_at":"2026-08-07T11:31:18.192540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.293791Z","title":"I ndo LEM and I ndo BERT : A benchmark dataset and pre-trained language model for I ndonesian NLP","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.293791Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:091034d2721cfcc0bd93d0a36fea2ea8806cfb5fff70e106f2e594fd2e3ade07","observation_id":"4acd185a-5fa6-4043-b52d-b158168a80ec","resolution":{"observed_at":"2026-08-07T11:31:18.293791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.328892Z","title":"Cross-lingual language model pretraining","venue":null,"work_id":"eba8892c-50c7-4e4f-a46b-62d4c75749e6","year":2019},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.368440Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:e6cbb430390adad11cd337d5ae450b295387e82fb1d7cd2e7a949b327de54ebd","observation_id":"1607e442-d972-4c85-9855-d7013fa5c9ab","resolution":{"observed_at":"2026-08-07T11:31:21.333574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-07T11:31:18.445979Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.445979Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:ea831f2f54ad8d1257ce2f463ab7801388a97d23e575112f478b7073bf4d1ba9","observation_id":"46ec1e55-256e-4a9e-93e0-e6f19d44e645","resolution":{"observed_at":"2026-08-07T11:31:18.445979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T11:31:18.569627Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.569627Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:4c4e6725b31d0f4b3b68b2420c6d5213b58d5e1f0bd91001c80c2a39553356a5","observation_id":"596bd67d-89e2-4ac1-9648-bf70aa533c77","resolution":{"observed_at":"2026-08-07T11:31:18.569627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.705580Z","title":"Scaling laws for fact memorization of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.705580Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:a943264fc13a973fa9c7b09803621fe59b0f172017fae8ec5776d1885f676c23","observation_id":"c56b29f5-1779-437c-897a-ba36dc60feca","resolution":{"observed_at":"2026-08-07T11:31:18.705580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.710364Z","title":"F in GPT : Large generative models for a small language","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.710364Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:37b9e7879072640505343953eedb7247c4b6f79db394bf3bc15a8252d8fb2ad3","observation_id":"a2e314a6-30ea-4a73-ba0d-8feff75fbc06","resolution":{"observed_at":"2026-08-07T11:31:18.710364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:18.766573Z","title":"A ra T 5: Text-to-text transformers for A rabic language generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.766573Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:b185375a1007e94e382fb774ed9dc3364ea95f5cfe51c69630c313034900a1da","observation_id":"de7d1893-e333-43e9-babc-8fc41a9a51dd","resolution":{"observed_at":"2026-08-07T11:31:18.766573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.afrinlp-1.11","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.902635Z","title":"Small data? no problem! exploring the viability of pretrained multilingual language models for low-resourced african languages","venue":null,"work_id":"406ea3b5-a9fc-4731-ab20-824945af7822","year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.840606Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:e1519eafefb74fa4aa70c7e2ab1e969016b65e1e98510cf42986bb4db3a83e45","observation_id":"6f4d2d0a-7a97-4d77-a12e-300c63d5ce52","resolution":{"observed_at":"2026-08-07T11:31:20.908745Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.303675Z","title":"Gpt-4 technical report, 2023","venue":null,"work_id":"b6a0f3e6-c938-4a8a-aa2a-458bbf80758a","year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:18.913026Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:56b29c108214f27ff8c351298b73dc9f80aba98973d08690c690d48483aeba2c","observation_id":"90c0fd41-2149-4724-b0c9-5235840473b5","resolution":{"observed_at":"2026-08-07T11:31:21.308358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:19.014252Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.014252Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:a87b9f1c7178fc8f1f175994aed0c76ede23836fe7a4821e66a2ab7b4f6efdcd","observation_id":"03f1b966-88f7-4f75-ad5c-ede8fa14ca70","resolution":{"observed_at":"2026-08-07T11:31:19.014252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.275867Z","title":"Bert multilingual model readme, 2019","venue":null,"work_id":"707a7b86-f096-4ab2-9ec5-252d4806e8d4","year":2019},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.099793Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:4ea5ab2803dca71200f6d85c0af9e21d52831ef8bb5fbbd4fcc466dbeae0a3db","observation_id":"b5cd3bca-a957-4e1c-8dd6-a857ca891e1a","resolution":{"observed_at":"2026-08-07T11:31:21.280890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.260119Z","title":"Multilingual t5: Massively multilingual pre-trained text-to-text transformer, 2021","venue":null,"work_id":"6a12b21c-dd84-44a5-bf9b-fedcaa465b6b","year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.174613Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:f92894b4a176c2ccf512ce540f071dc5dd24df8954ecfab901f91ddc78f91083","observation_id":"5880c09b-e1eb-4d49-ab35-6a34003be8ae","resolution":{"observed_at":"2026-08-07T11:31:21.265242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.244321Z","title":"NLLB-200 : Distilled 600m-parameter model of No Language Left Behind ( NLLB ), 2022","venue":null,"work_id":"3bdb9159-5d7d-4629-8c88-4c74e33ff7a2","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.236141Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:33d3e2779fc2c1f8dfef40df9f126e17fac0d5633db9dc8a589f295ad2c82095","observation_id":"ba1d6127-8c37-422e-b29f-b27e20dc8b41","resolution":{"observed_at":"2026-08-07T11:31:21.249399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:19.320569Z","title":"How good is your tokenizer? on the monolingual performance of multilingual language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.320569Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:658463b37cf1ccef685e147cfec9502c7b049f27742e4cd80918ea6267db3fa7","observation_id":"4f8376fa-4cab-4c36-afa5-49c46958233a","resolution":{"observed_at":"2026-08-07T11:31:19.320569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T11:31:19.398596Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.398596Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:affe27e97a7fdf5719d0edf140f84f70d11079978f8809abaae710973ce2e839","observation_id":"078b2b4c-c876-4dee-85d4-a51659012104","resolution":{"observed_at":"2026-08-07T11:31:19.398596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:19.577749Z","title":"The language barrier: Dissecting safety challenges of LLM s in multilingual contexts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.577749Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:3543da3903e84a3d36e4ed2b06b4c72f59f9c14d01072f63c935b42ec9818833","observation_id":"d0920318-6f80-435e-8453-24227f48b885","resolution":{"observed_at":"2026-08-07T11:31:19.577749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.217501Z","title":"Gemini: A family of highly capable multimodal models, December 2023","venue":null,"work_id":"41c6f80b-83c7-49c6-aeae-81a8954abfbd","year":2023},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.672142Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:fa6f7c0c280a2b4c7c2d58e00cc8548862bea7693a47ae51f675440442c6885d","observation_id":"23004449-b85d-4a41-9d3f-c47e908c8c05","resolution":{"observed_at":"2026-08-07T11:31:21.222377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.199145Z","title":"Costa-jussà, James Cross, Onur Çelebi, Maha Elbayad, Kenneth Heafield, Kevin Heffernan, Elahe Kalbassi, Janice Lam, Daniel Licht, Jean Maillard, et al","venue":null,"work_id":"c28baef2-1581-43c2-a561-d5070b4e6aec","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.777258Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:fb161de6c6d2688239fe07934914be656cdafe05723061ee7b373942dfa1f62b","observation_id":"20e55edb-7efa-4583-841d-149e9b5181bb","resolution":{"observed_at":"2026-08-07T11:31:21.206621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13737","last_updated":"2024-06-23T12:06:27Z","snapshot_observed_at":"2026-07-06T17:47:47.206342Z","submitted_at":"2024-03-20T16:43:42Z","title":"EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task Evaluation","version":4},"cited_work":{"arxiv_id":"2403.13737","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13737","snapshot_observed_at":"2026-08-07T11:31:21.038499Z","title":"EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task Evaluation","venue":"cs.CL","work_id":"8e44864d-d0cb-426b-a50a-99bba4a5cae7","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.896131Z"},"links":{"cited_paper":"/paper/2403.13737","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:87f5f8abdeae1f97b14e2652a9fa82b04ef15e316409118a113258e38245a16c","observation_id":"ef751f80-1672-4bcd-a625-b5abee9a1909","resolution":{"observed_at":"2026-08-07T11:31:21.043388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.182701Z","title":"E thio LLM : Multilingual large language models for E thiopian languages with task evaluation","venue":null,"work_id":"ae452cc8-50bc-4989-9b50-8dd68a3dacd0","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:19.988573Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:0284f939c4ca0f36d30a756e8bee5699b367f2b941eeb8c27b5ae878d1a420d4","observation_id":"87f985d4-aa3c-4719-b3c8-61fb6e5c02c3","resolution":{"observed_at":"2026-08-07T11:31:21.187353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.167886Z","title":"E thio MT : Parallel corpus for low-resource E thiopian languages","venue":null,"work_id":"dce2ee6f-f9fb-40ff-9dfe-d6b744ff1e54","year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.074637Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:db741fb7a901cfab551636e9a9656df466af4f4c2c17ab844d887e39713e7493","observation_id":"97667762-d008-4c3d-a254-e9977070e972","resolution":{"observed_at":"2026-08-07T11:31:21.172576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.207198Z","title":"Aya model: An instruction finetuned open-access multilingual language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.207198Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:d909c99f37be57be2bf76471f7f19d826fc5854fcc040ddfcf29587a1822cdc0","observation_id":"83dcaf8f-26d2-4c35-bbfe-b1ef1e03b5a5","resolution":{"observed_at":"2026-08-07T11:31:20.207198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03350","last_updated":"2024-12-28T09:18:36Z","snapshot_observed_at":"2026-08-04T03:34:32.259687Z","submitted_at":"2024-11-04T04:43:01Z","title":"A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03350","snapshot_observed_at":"2026-08-07T11:31:20.338729Z","title":"A comprehensive survey of small language models in the era of large language models: Techniques, enhancements, applications, collaboration with llms, and trustworthiness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.338729Z"},"links":{"cited_paper":"/paper/2411.03350","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:4b9e6932236611c0c308ca971c8a8cfbea20bc172b67012e73970dd5d19faddd","observation_id":"31136607-4831-46bb-ad2a-0bc3b980b891","resolution":{"observed_at":"2026-08-07T11:31:20.338729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:21.143019Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"62c9ae29-4baa-408f-999b-9483872c17e3","year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.389951Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:58ff9cfb4e73dbc08c1a9d5913f83c89b65931ab8febaef4255010bf5822a743","observation_id":"696e49c9-e0f2-4690-816f-4c0777291ad4","resolution":{"observed_at":"2026-08-07T11:31:21.147854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-07T11:31:20.468482Z","title":"Bloom: A 176b-parameter open-access multilingual language model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.468482Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:29a91b84405f9fbb07fb740ca2f9a641cc11d7e932a1797882d01832beec2042","observation_id":"b18aaf85-cd10-4528-bcf8-97b7a9b56839","resolution":{"observed_at":"2026-08-07T11:31:20.468482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.564776Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.564776Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:46d6158f2256b2b8bac361be20939a920814074cd92bd0cb302174c5baa4202a","observation_id":"e4c0cbba-9496-44c1-b415-289b4014c78e","resolution":{"observed_at":"2026-08-07T11:31:20.564776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.640827Z","title":"m T 5: A massively multilingual pre-trained text-to-text transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.640827Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:d3d619cd3dde6c4e49403a7c0739463caa7780386950529dbe4896c1efd0ba63","observation_id":"cda4dac2-4240-426a-b36d-0b09db8f689b","resolution":{"observed_at":"2026-08-07T11:31:20.640827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:31:20.747562Z","title":"B y T 5: Towards a token-free future with pre-trained byte-to-byte models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:31:20.747562Z"},"links":{"citing_paper":"/paper/2506.02280"},"observation_digest":"sha256:9dd936e362de86bcd085be3dd664f57dac319f80e29d3547c79d7848408ef8de","observation_id":"5d8fe745-4ecd-4917-a8ae-86e683895cdd","resolution":{"observed_at":"2026-08-07T11:31:20.747562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02280","last_updated":"2025-06-26T01:01:18Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T11:24:46.340059Z","submitted_at":"2025-06-02T21:39:40Z","title":"The State of Large Language Models for African Languages: Progress and Challenges"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2506.02280."}