{"as_of":"2026-08-19T02:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f8d1801f84686987c53bc991ee1f3a6e7cd877e0de8d99ad3ab2295b1309afb2","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T16:27:34.558239Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.13453/citation-record","integrity":"/paper/2411.13453/integrity","json":"/paper/2411.13453/citation-record.json","paper":"/paper/2411.13453"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1912.06670","last_updated":"2020-03-05T20:37:08Z","snapshot_observed_at":"2026-08-12T13:38:15.911519Z","submitted_at":"2019-12-13T19:22:44Z","title":"Common Voice: A Massively-Multilingual Speech Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06670","snapshot_observed_at":"2026-08-12T16:27:34.226624Z","title":"Common voice: A massively-multilingual speech corpus","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.226624Z"},"links":{"cited_paper":"/paper/1912.06670","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:dc846a81996135ce2675f3734af5906be1b39cafa577835bcefedd4085d80e0c","observation_id":"34702040-3119-4a93-9df6-9688a1d41e76","resolution":{"observed_at":"2026-08-12T16:27:34.226624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15358","last_updated":"2024-03-26T17:26:50Z","snapshot_observed_at":"2026-08-18T13:56:41.149067Z","submitted_at":"2024-03-26T17:26:50Z","title":"Introducing Syllable Tokenization for Low-resource Languages: A Case Study with Swahili","version":1},"cited_work":{"arxiv_id":"2406.15358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.15358","snapshot_observed_at":"2026-08-12T16:27:35.036786Z","title":"Introducing Syllable Tokenization for Low-resource Languages: A Case Study with Swahili","venue":"cs.CL","work_id":"7983c1b4-b326-4145-a1fb-06509a33adfa","year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.233436Z"},"links":{"cited_paper":"/paper/2406.15358","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:db9153572c2df7c7ef0f4741f74ca8bb8d50c77598fa11e6f653dbf1189b2f20","observation_id":"6f055328-088f-4b3f-8c1e-7abef3e3fa13","resolution":{"observed_at":"2026-08-12T16:27:35.042902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09164","last_updated":"2018-06-18T10:42:11Z","snapshot_observed_at":"2026-08-14T19:32:50.112446Z","submitted_at":"2018-03-24T21:17:52Z","title":"Low-Resource Speech-to-Text Translation","version":2},"cited_work":{"arxiv_id":"1803.09164","doi":null,"metadata_source":"pith","pith_arxiv_id":"1803.09164","snapshot_observed_at":"2026-08-12T16:27:35.011759Z","title":"Low-Resource Speech-to-Text Translation","venue":"cs.CL","work_id":"09ef9a29-603c-42ab-8b05-c21a067cf78b","year":2018},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.239257Z"},"links":{"cited_paper":"/paper/1803.09164","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:b639e7c4917646e2550c63ef2331f15cb2126bb7732aaf79ea606277857e787c","observation_id":"af127fa5-8f97-4672-8a99-988d7430b122","resolution":{"observed_at":"2026-08-12T16:27:35.017312Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14928","last_updated":"2020-10-26T08:56:46Z","snapshot_observed_at":"2026-08-14T09:39:46.830093Z","submitted_at":"2020-04-30T16:29:56Z","title":"Language Model Prior for Low-Resource Neural Machine Translation","version":3},"cited_work":{"arxiv_id":"2004.14928","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.14928","snapshot_observed_at":"2026-08-12T16:27:34.990720Z","title":"Language Model Prior for Low-Resource Neural Machine Translation","venue":"cs.CL","work_id":"324759df-e0b3-497e-8715-2a4f19efcfcb","year":2020},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.244821Z"},"links":{"cited_paper":"/paper/2004.14928","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:26a435d9509c3550b5e244df6d4e025651e2a4d0e241c8755e97ac0f57995825","observation_id":"a04cd5fb-04fc-4784-a768-93f47e808e37","resolution":{"observed_at":"2026-08-12T16:27:34.994829Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.540517Z","title":"Decolonising speech and language technology","venue":null,"work_id":"d2822bd0-d146-4b31-9852-2797a1400638","year":2020},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.251212Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:6cff5a46b65f29a2c1b225399fcd47195afd6a3db5997a9e057787bf962984df","observation_id":"3c5f4f28-17f2-4395-9468-43b57ade6e60","resolution":{"observed_at":"2026-08-12T16:27:35.544068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.04279","last_updated":"2016-06-14T09:43:36Z","snapshot_observed_at":"2026-08-15T16:56:46.932021Z","submitted_at":"2016-06-14T09:43:36Z","title":"Cross-Lingual Morphological Tagging for Low-Resource Languages","version":1},"cited_work":{"arxiv_id":"1606.04279","doi":null,"metadata_source":"pith","pith_arxiv_id":"1606.04279","snapshot_observed_at":"2026-08-12T16:27:34.970490Z","title":"Cross-Lingual Morphological Tagging for Low-Resource Languages","venue":"cs.CL","work_id":"d6de1b92-0c52-4958-b032-f06c7a4241ac","year":2016},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.257028Z"},"links":{"cited_paper":"/paper/1606.04279","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:88342083a6068c5a1993e291f9da42debf76efe9db7b512404fe427dd45706bb","observation_id":"f6b9ca32-09a1-48e8-90f9-8b44c3f9e344","resolution":{"observed_at":"2026-08-12T16:27:34.975312Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16512","last_updated":"2024-06-25T11:54:23Z","snapshot_observed_at":"2026-08-17T03:52:39.338313Z","submitted_at":"2024-03-25T07:55:29Z","title":"LLMs Are Few-Shot In-Context Low-Resource Language Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16512","snapshot_observed_at":"2026-08-12T16:27:34.263667Z","title":"Llms are few-shot in-context low-resource language learners","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.263667Z"},"links":{"cited_paper":"/paper/2403.16512","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:eff7cd2724ede707c4aaef422559d1056c28523129930166f49d43bdfe871460","observation_id":"a9a5ae10-201f-4090-a0d4-92497e26b71b","resolution":{"observed_at":"2026-08-12T16:27:34.263667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05426","last_updated":"2019-04-10T20:22:31Z","snapshot_observed_at":"2026-08-14T16:48:23.424746Z","submitted_at":"2019-04-10T20:22:31Z","title":"A Grounded Unsupervised Universal Part-of-Speech Tagger for Low-Resource Languages","version":1},"cited_work":{"arxiv_id":"1904.05426","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.05426","snapshot_observed_at":"2026-08-12T16:27:34.922979Z","title":"A Grounded Unsupervised Universal Part-of-Speech Tagger for Low-Resource Languages","venue":"cs.CL","work_id":"5b2ed924-edd3-4b79-ae73-8f0c1134dac4","year":2019},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.269035Z"},"links":{"cited_paper":"/paper/1904.05426","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:6640395c0e08765a58ad74e2a9f41945a627f148f6aace0267d26ed3c32ea22b","observation_id":"c576cc7a-14f1-4d97-9aa3-08c2847a3b67","resolution":{"observed_at":"2026-08-12T16:27:34.928086Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.529786Z","title":"Two decades of unsupervised pos induction: How far have we come? In Proceedings of the 2010 Conference on Empirical Methods in Natural Language Processing, pages 575–584, 2010","venue":null,"work_id":"b6d361b5-f7cd-4280-82e6-f020382bb887","year":2010},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.274846Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:d3210b4e1bcab19c53ed6852d56b0b6ed085d1f2d15f0788c6cfd0b7caf2d8c8","observation_id":"791db6f0-03a5-47db-a5ab-e04a67bf970c","resolution":{"observed_at":"2026-08-12T16:27:35.533661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.520051Z","title":"Selection criteria for low resource language programs","venue":null,"work_id":"9ae4f453-0bb1-42d9-832b-1bcbf245b9fb","year":2016},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.281056Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:f615ea7ae57558b4752c8ec3ed52d4538b8cbce7c6f9f9510d0f2a8e909fa65b","observation_id":"9e7fb22b-1db8-46e3-948a-8227d75e281e","resolution":{"observed_at":"2026-08-12T16:27:35.523598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.507618Z","title":"Data collection pipeline for low-resource languages: A case study on constructing a tetun text corpus","venue":null,"work_id":"add3100f-68d8-47b8-bb1e-4254413b23f6","year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.286313Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:e092c9ec904ea6ad5ee62461f9bd974507a068ad162719448f4b2454dcc91419","observation_id":"3227f545-7436-47d3-aac6-9cf67ef007f3","resolution":{"observed_at":"2026-08-12T16:27:35.513553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-12T16:27:34.291284Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.291284Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:e91f94feaf79bd983ea533aa67becc893a14de7c55afd2d5de6258002547cee1","observation_id":"34109154-e281-46a7-9c7a-c1da37c2d472","resolution":{"observed_at":"2026-08-12T16:27:34.291284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.497576Z","title":"Statistical identification of language","venue":null,"work_id":"726dd757-11dc-4fb4-8b67-0586c9b5befa","year":1994},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.299102Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:b9d94acdbeb6279f974d2ef4b25e76462184acd2ebee52f98c3aaf27fb526af5","observation_id":"706f147f-eef4-4159-8c92-5e6186f8674c","resolution":{"observed_at":"2026-08-12T16:27:35.500918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.487735Z","title":"What can we get from 1000 tokens? a case study of multilingual pos tagging for resource-poor languages","venue":null,"work_id":"f863f92e-20d7-40a3-944f-0eae0852a9ed","year":2014},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.303708Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:fc5a8cc27cab81f6e854756bfaa77ec685f1e5e6252f7d9150bd99716a8250fb","observation_id":"4825b39e-8dcc-48cf-a34e-fb793dd40d86","resolution":{"observed_at":"2026-08-12T16:27:35.491388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.01133","last_updated":"2016-07-05T07:31:22Z","snapshot_observed_at":"2026-08-14T21:49:49.140367Z","submitted_at":"2016-07-05T07:31:22Z","title":"Learning when to trust distant supervision: An application to low-resource POS tagging using cross-lingual projection","version":1},"cited_work":{"arxiv_id":"1607.01133","doi":null,"metadata_source":"pith","pith_arxiv_id":"1607.01133","snapshot_observed_at":"2026-08-12T16:27:34.888756Z","title":"Learning when to trust distant supervision: An application to low-resource POS tagging using cross-lingual projection","venue":"cs.CL","work_id":"7ae9704f-f609-4bfe-b2c3-ca9fe425d62a","year":2016},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.307971Z"},"links":{"cited_paper":"/paper/1607.01133","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:911a0736e88aef311636b125f81e2597a91f40dd66389c6f164ca2c20359344e","observation_id":"5058afb4-e58c-4819-bf06-4fe8bf2ad541","resolution":{"observed_at":"2026-08-12T16:27:34.893586Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.00424","last_updated":"2017-05-01T05:58:56Z","snapshot_observed_at":"2026-08-17T11:18:20.132026Z","submitted_at":"2017-05-01T05:58:56Z","title":"Model Transfer for Tagging Low-resource Languages using a Bilingual Dictionary","version":1},"cited_work":{"arxiv_id":"1705.00424","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.00424","snapshot_observed_at":"2026-08-12T16:27:34.865686Z","title":"Model Transfer for Tagging Low-resource Languages using a Bilingual Dictionary","venue":"cs.CL","work_id":"749cc1f0-f62b-40fa-9e85-130939c302c4","year":2017},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.312424Z"},"links":{"cited_paper":"/paper/1705.00424","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:df019f4fd82fa87a673f3dc8f83c2b17f933625f1a8fda280ec01c2601195270","observation_id":"1c0a6c87-1a77-4315-af08-323b758179fe","resolution":{"observed_at":"2026-08-12T16:27:34.871318Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1515/9783110274615","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:34.596329Z","title":"Manuale di linguistica sarda","venue":null,"work_id":"7eea1666-24cd-44f5-a2f6-2ad3887fe3f0","year":2017},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.319168Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:db8fa1fcf7777a8f3d7fecf20d1cb5153e7e1a5d68b2d2f4fccc7670f87525e6","observation_id":"fe8dd8b7-3a12-4a89-a060-a3fc4412fac3","resolution":{"observed_at":"2026-08-12T16:27:34.602919Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.477252Z","title":"Ideologies and expressed attitudes in internet: Comparing ethnic identities in two regional communities (veneto and sardinia)","venue":null,"work_id":"e06d2c2c-db74-41e2-b45a-1ce455aa92d4","year":2016},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.323864Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:28efa95664782d264119c1069e2bb33d0b848dda3aa3b1749deb2022378dd0ad","observation_id":"2c41e403-abee-4aa0-8739-35218bb37a14","resolution":{"observed_at":"2026-08-12T16:27:35.481063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.05756","last_updated":"2020-08-13T08:41:44Z","snapshot_observed_at":"2026-08-14T09:38:34.697489Z","submitted_at":"2020-08-13T08:41:44Z","title":"Metrics for Multi-Class Classification: an Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.05756","snapshot_observed_at":"2026-08-12T16:27:34.328030Z","title":"Metrics for multi-class classification: an overview","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.328030Z"},"links":{"cited_paper":"/paper/2008.05756","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:1bcb891ad798ab169fbcb58ffe4656b5de1d5d94731022d865fbd27d187584a0","observation_id":"aa923e97-fb3f-421a-952c-004dcad19459","resolution":{"observed_at":"2026-08-12T16:27:34.328030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.466604Z","title":"Speech generation for indigenous language education","venue":null,"work_id":"93ae6db1-bc78-4167-a50e-e80846a91453","year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.333057Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:7e647fa1d1e4adb2e2b909daaaa63c23359e8d705be49d8ef9c70161395b1e90","observation_id":"0c6cec73-a5c1-4527-bfc5-d23d2dd9a030","resolution":{"observed_at":"2026-08-12T16:27:35.470533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.455194Z","title":"Recent advances in apertium, a free/open-source rule-based machine translation platform for low-resource languages","venue":null,"work_id":"fea356bb-ba61-4afa-a007-46623c1be78f","year":2021},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.337704Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:9a1d0ccf415e5328529a8018bf8631e97b97e8c60e16f3e82b637377beac43f6","observation_id":"24bad346-a6ec-474c-a578-adf6e0378980","resolution":{"observed_at":"2026-08-12T16:27:35.458984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.444601Z","title":"Practical Natural Language Processing for Low-Resource Languages","venue":null,"work_id":"7eb8bb6e-1ca8-47d9-bcdc-f14c8c6962a4","year":2015},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.342532Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:3239fcc69660ef156cdb601ce109a1d74c165784915c09740a746677f2ef4392","observation_id":"79d3b575-26fa-4497-9d55-973376134851","resolution":{"observed_at":"2026-08-12T16:27:35.448196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.433540Z","title":"Synthesizer voice quality of new languages calibrated with mean mel cepstral distortion","venue":null,"work_id":"c185d6ce-447a-420c-83da-ee9d106c9884","year":2008},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.346807Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:05ec66a9c1468a0925543f6a95ea74c367123f29c2464788b3363afdf113cf6c","observation_id":"e0e8adf9-d63e-497e-b53b-c73c6a1e0242","resolution":{"observed_at":"2026-08-12T16:27:35.437459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.422545Z","title":"An augmented translation technique for low resource language pair: Sanskrit to hindi translation","venue":null,"work_id":"23f0af07-6d82-4428-b28f-76a474b64a93","year":2019},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.353613Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:be94f58da0a4a36bc746b05f05130f358450d63a9856f23b5c6ed18156565b54","observation_id":"9e0c0147-4a8d-45c9-acc9-079c02b0b5c1","resolution":{"observed_at":"2026-08-12T16:27:35.426807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.412083Z","title":"adaptmllm: Fine-tuning multilingual language models on low-resource languages with integrated llm playgrounds","venue":null,"work_id":"abd3843e-7098-41d1-86fc-fcb8dd9ff748","year":2023},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.358539Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:20781f54d0ed89a9af1c99080527ca97e4ad32fb4bf522baf42e01daee6b7894","observation_id":"8d61e260-6758-4d7c-9929-0f93a512c0f6","resolution":{"observed_at":"2026-08-12T16:27:35.415939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:34.364728Z","title":"A survey on evaluation metrics for machine translation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.364728Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:1b7a1b3f09181ead9609f89684a0496361006fb1fe5ee78668df3624501e42b8","observation_id":"5b6e8ba8-4973-4786-bad1-349cf505a675","resolution":{"observed_at":"2026-08-12T16:27:34.364728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.395912Z","title":null,"venue":null,"work_id":"098dd5d1-f0fb-4e09-b4b7-33fae98bc2c5","year":2021},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.368861Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:99abb9bf50c929f12ab161b4033c0710dde3b1ba2cf67a1210c217ed70897568","observation_id":"14ba38af-9aae-49a7-ab1c-971cc20ad859","resolution":{"observed_at":"2026-08-12T16:27:35.399130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.11954","last_updated":"2020-04-28T19:51:43Z","snapshot_observed_at":"2026-08-18T17:39:44.746473Z","submitted_at":"2020-04-24T19:30:38Z","title":"Practical Comparable Data Collection for Low-Resource Languages via Images","version":2},"cited_work":{"arxiv_id":"2004.11954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.11954","snapshot_observed_at":"2026-08-12T16:27:34.828543Z","title":"Practical Comparable Data Collection for Low-Resource Languages via Images","venue":"cs.CL","work_id":"e4a554fd-51d6-4568-bda1-afd24cb3eeb2","year":2020},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.374759Z"},"links":{"cited_paper":"/paper/2004.11954","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:790ede108e303810bd70d46cacd7a780e0140deb42c2aad25df078fbfe7fcecc","observation_id":"5e6414a3-a59f-47ba-b22b-aa1d63e45eb3","resolution":{"observed_at":"2026-08-12T16:27:34.833863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07264","last_updated":"2020-06-12T15:21:57Z","snapshot_observed_at":"2026-08-13T05:37:12.453613Z","submitted_at":"2020-06-12T15:21:57Z","title":"Low-resource Languages: A Review of Past Work and Future Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07264","snapshot_observed_at":"2026-08-12T16:27:34.380253Z","title":"Low-resource languages: A review of past work and future challenges","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.380253Z"},"links":{"cited_paper":"/paper/2006.07264","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:f9579db335c538178f52fbc07ef347819e6e88dceba1cc2645804c38205ad278","observation_id":"ee7decd5-c4b7-4f2a-add8-89607f90f108","resolution":{"observed_at":"2026-08-12T16:27:34.380253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.385583Z","title":"Neural transition-based string transduction for limited-resource setting in morphology","venue":null,"work_id":"a8912bf0-ea1b-4150-ae3f-2029186ce40a","year":2018},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.386215Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:a0a726d65ed41f63fde0b90e831a0ff3b9fa39deec9ede1bb5807b242060d080","observation_id":"5234d0b9-63a0-48e0-b3ef-d7840f6aeaa2","resolution":{"observed_at":"2026-08-12T16:27:35.389268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.375380Z","title":"Lingue di minoranza a scuola: uno sguardoalla sardegna a dieci anni dalla legge 482/99","venue":null,"work_id":"1ed3cee0-0be8-43fb-a4ee-38f36b51a5ab","year":2010},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.390689Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:916d272d9299d1ad2d56e1c0a29d32785dc81fc92c1bb7e85efd9b1b419f26b9","observation_id":"f5f76be8-b113-4538-8822-5f2843debcec","resolution":{"observed_at":"2026-08-12T16:27:35.379250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.364779Z","title":"Dialetti su instagram: usi, differenze e atteggiamenti linguistici","venue":null,"work_id":"d7e68879-ca91-4258-b444-10cdf7a86183","year":2021},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.394636Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:aa5dc2377bb501a9b96f545aa0eb8f14bbd3e16861c3cc1802192124d07dd5ae","observation_id":"12f103d0-4c39-454f-bf27-b0f80dcd1718","resolution":{"observed_at":"2026-08-12T16:27:35.368598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.354041Z","title":"The internet as a rescue tool of endangered languages: Sardinian","venue":null,"work_id":"3687ab87-fa22-47e7-b661-c30eafde0976","year":2000},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.398728Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:65d2a3e467760c5a4f40f4198007316045f97095033f2268ded2731e8eae4ced","observation_id":"1cebc11d-b9c8-4b71-8e76-c1c752380ff5","resolution":{"observed_at":"2026-08-12T16:27:35.358076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.342370Z","title":"Class-based n-gram models of natural language","venue":null,"work_id":"7a9e19f7-6362-484e-a125-7119642eeb3c","year":1992},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.403210Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:4facf8f63502b230055ecc4af1fb9e06f59c2ac69cb3f6322db8e84ee50a427f","observation_id":"c7f33cd2-2235-4f71-b868-cf6a2626c10e","resolution":{"observed_at":"2026-08-12T16:27:35.346455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.331645Z","title":"Efforts to standardise minority languages","venue":null,"work_id":"abbab5b1-9872-4785-9352-636c123b5549","year":2021},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.407294Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:a742dbba8684a6c63e301a243f3b5b984a6ef305de68822b790e323a751cdfcc","observation_id":"b2330133-c07a-4653-bba4-e0e8aa385c5f","resolution":{"observed_at":"2026-08-12T16:27:35.335320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.321778Z","title":"Merlo and Scuola normale superiore (Italy)","venue":null,"work_id":"90decc18-c95d-4d1a-8b15-38fbb13f420c","year":2009},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.412157Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:f384b77bede28a4e31e4401ef372c731a104525fc233f79882697e9acef64650","observation_id":"75c46e9c-5946-4fbf-93f5-f93fc5c8de66","resolution":{"observed_at":"2026-08-12T16:27:35.325269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.311252Z","title":"Applying AI-based Tools and Technologies Towards Revitalization of Indigenous and Endangered Languages","venue":null,"work_id":"7c0fd12b-78dc-4587-b893-4dac99427a7d","year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.416911Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:c8be5a5eea1077f5fe317245dcfad6928750ce3384f83a43a8526474e046e2f6","observation_id":"909cd17c-00ea-4a84-bbf2-5171091e0d12","resolution":{"observed_at":"2026-08-12T16:27:35.315094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.301239Z","title":"Attitudes towards sardinian and italian finally compared via the matched-guise technique","venue":null,"work_id":"938c2ee6-6582-4f3b-a888-248219cddf6b","year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.421121Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:0ad26dca1291cbdfb0236260bef748df78cdd4e5bf3f4b48c28862522ab86b2e","observation_id":"92b258b4-c81e-4045-b440-fe1b0b845041","resolution":{"observed_at":"2026-08-12T16:27:35.305009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.291046Z","title":"The corpus of Sardinian emigrants:a tool for a quantitative approach to contact phenomena","venue":null,"work_id":"85e46058-8139-4080-82b6-8b3780af9e75","year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.426629Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:0e0ca4b8770d70d36d7cce0d593179fe73536d66e854baa8e423b553563590ba","observation_id":"9078f059-ae5a-4e18-81dd-26fb2c01292b","resolution":{"observed_at":"2026-08-12T16:27:35.294973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.280421Z","title":"The valorisation of african languages and policies in the african education systems: A case of uganda","venue":null,"work_id":"8c826621-2248-4ede-97bf-bcf2138584ba","year":2014},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.432257Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:e46201ee447fccfb3ed4acea2520516deb30ab4957c333fad20edd53d433309e","observation_id":"2e3ab8ca-7ba0-4c5e-83e2-5288458a2a76","resolution":{"observed_at":"2026-08-12T16:27:35.284256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.268141Z","title":"Revitalizing endangered languages: A practical guide","venue":null,"work_id":"c5b8d948-5856-4b8a-a961-0dd74dfe8b52","year":2021},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.436939Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:904fd953b4820d68dac03d425374f57e248a520189c0cbfaae073fa7c7ff9794","observation_id":"f4819599-2020-4e94-b7f1-04818a19ea2c","resolution":{"observed_at":"2026-08-12T16:27:35.272231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09855","last_updated":"2024-07-13T11:29:20Z","snapshot_observed_at":"2026-08-16T13:34:31.896117Z","submitted_at":"2024-07-13T11:29:20Z","title":"Building pre-train LLM Dataset for the INDIC Languages: a case study on Hindi","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09855","snapshot_observed_at":"2026-08-12T16:27:34.441542Z","title":"Building pre-train llm dataset for the indic languages: a case study on hindi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.441542Z"},"links":{"cited_paper":"/paper/2407.09855","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:1d8e0f481442cac064da5e69d2aebdfd99b33c116f5cca485bf7100b4b5990ee","observation_id":"6b17f21f-fde3-4d86-a882-e1642f5193a9","resolution":{"observed_at":"2026-08-12T16:27:34.441542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.253707Z","title":"An empirical analysis of word error rate and keyword error rate","venue":null,"work_id":"1afd7367-7bac-4478-a10b-eb5c2c688e5d","year":2008},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.446672Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:0c414cbeadd346394ca4a1151c3cfe97a0eaf8a35c7295f975a9d91e65d354db","observation_id":"3e563d2f-d970-42e9-a2d0-ab7f1fccc1a9","resolution":{"observed_at":"2026-08-12T16:27:35.258816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05777","last_updated":"2024-05-09T13:54:22Z","snapshot_observed_at":"2026-08-16T13:54:02.353746Z","submitted_at":"2024-05-09T13:54:22Z","title":"Towards a More Inclusive AI: Progress and Perspectives in Large Language Model Training for the S\\'ami Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05777","snapshot_observed_at":"2026-08-12T16:27:34.450868Z","title":"Towards a more inclusive ai: Progress and perspectives in large language model training for the s \\’ami language","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.450868Z"},"links":{"cited_paper":"/paper/2405.05777","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:b3c5b3d37f5ab515183964bde17e7046f0d42d3d065ab47406d3fe2bc1a88839","observation_id":"decc02f7-955b-4a6f-9c3c-46d0dc78df34","resolution":{"observed_at":"2026-08-12T16:27:34.450868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.242094Z","title":"Carta dei dialetti d’italia","venue":null,"work_id":"20a5d53f-8e1a-43be-9617-7b2047391658","year":1977},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.456534Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:4396c4a87039bf8f42b5b4dbb9a4cc84885f23baa0e9755fd0717933ddcf616d","observation_id":"befb9ba0-3494-4c25-8cb3-d6db4c4afcd5","resolution":{"observed_at":"2026-08-12T16:27:35.245913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.230008Z","title":"Appunti per un corpus di sardo multimediale","venue":null,"work_id":"80a678a4-a175-4ddd-be05-31ec6472e30b","year":2022},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.461645Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:efb572a802ad9e33a5ca56ef16a5da26d9cf902fc33861eea07bd2c20336e374","observation_id":"bbf4cbbf-d17e-4598-a58e-289db0748c5c","resolution":{"observed_at":"2026-08-12T16:27:35.234224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.218679Z","title":"Applying monte carlo techniques to language identification","venue":null,"work_id":"47c3821c-6461-449c-95be-51423bf8fce9","year":2001},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.466484Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:deaea00952608ab5e0fcb36694ce17c87b43b2844ed65bfb8805d8ccb6c74866","observation_id":"d70aa0cf-4f24-4f49-a638-d5cfd422a964","resolution":{"observed_at":"2026-08-12T16:27:35.222498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-08-16T23:32:22.645653Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-12T16:27:34.471360Z","title":"Robust speech recognition via large-scale weak supervision, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.471360Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:7a7ed547cd1afdd8fe6a3fdad7ffc11d7c491e6e5cb0f9f9441a3ffa4317b3f7","observation_id":"8464164d-4005-49db-a594-f78b13fa8695","resolution":{"observed_at":"2026-08-12T16:27:34.471360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.208127Z","title":"Sardinian on facebook: Analysing diatopic varieties through translated lexical lists","venue":null,"work_id":"d589d2f8-db71-4635-8448-27a07c21921f","year":2016},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.476482Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:1b253e183aeb94991a01e6f577beddadddc945e8d718a6121111479cc31733e9","observation_id":"1f5230b1-16da-40a9-8e14-6fc2692daea6","resolution":{"observed_at":"2026-08-12T16:27:35.212257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.197150Z","title":"Analyzing asr pretraining for low-resource speech-to- text translation","venue":null,"work_id":"d00e00a1-e0cc-4772-a977-e302360bfd83","year":2020},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.481079Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:99a80ba29a2b542a223f5e445fbcf42f897186c9de8fe9ceffd63ddda5ed5097","observation_id":"9bf3a62c-5063-4117-a4b5-4c86e69578d5","resolution":{"observed_at":"2026-08-12T16:27:35.200966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.186035Z","title":"Low-resource taxonomy enrichment with pretrained language models","venue":null,"work_id":"bee17bca-8ce7-4ce1-a9a5-2bd060e89315","year":2021},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.486659Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:429142bb884f2fa8f66e508955f6ab3d02d844ce6f8bbe6c9f0584d38ad37daa","observation_id":"15b1fa29-8000-42af-a336-d79e6a573925","resolution":{"observed_at":"2026-08-12T16:27:35.190017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.06508","last_updated":"2019-07-02T07:43:40Z","snapshot_observed_at":"2026-08-14T16:47:06.875748Z","submitted_at":"2019-04-13T08:51:11Z","title":"End-to-end Text-to-speech for Low-resource Languages by Cross-Lingual Transfer Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.06508","snapshot_observed_at":"2026-08-12T16:27:34.492145Z","title":"End-to-end text-to-speech for low-resource languages by cross-lingual transfer learning","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.492145Z"},"links":{"cited_paper":"/paper/1904.06508","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:7150926bb405daa7fb1ac80c25aa66036993fc3f74ffbaf193f640afb81421d1","observation_id":"b165687c-bc65-44a2-b1ed-56a33863f69a","resolution":{"observed_at":"2026-08-12T16:27:34.492145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.174489Z","title":"Rule-based machine translation for the italian-sardinian language pair","venue":null,"work_id":"9b700488-1267-4c59-a8d8-5fbaee1cf917","year":2017},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.497626Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:1d9aeb5e739fa7510c7bd3fdbdc756240af164748371005031638982bdd4b494","observation_id":"b0939d9e-6307-49a7-8c5e-dc894650fafa","resolution":{"observed_at":"2026-08-12T16:27:35.178531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.162393Z","title":"Capitolo secondo: Valori, opinioni e atteggiamenti verso le lingue locali","venue":null,"work_id":"56bfc6b7-c4c6-4d05-815a-46d07103a9c1","year":2007},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.502281Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:5b86fc9e7d6479d8fa21021009acefc397e7e09fe91e6c90579fad61f69ee14c","observation_id":"7bb76d59-520a-457d-a8ca-55500f9d0b80","resolution":{"observed_at":"2026-08-12T16:27:35.167016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"edu/2277269","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:34.725435Z","title":"La lingua e la cultura della Sardegna","venue":null,"work_id":"1835b465-cd31-431a-9e48-1d0d32316722","year":2003},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.506696Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:5fda84798f6f0fe583573ea23a45aecdb9150588f434f213adbd5c6c52860e67","observation_id":"b5e8c331-8561-4d1b-b5c1-9038957dd6ef","resolution":{"observed_at":"2026-08-12T16:27:34.733272Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.149681Z","title":"Measuring speech quality for text-to-speech systems: development and assessment of a modified mean opinion score (mos) scale","venue":null,"work_id":"89dbb8c3-96dc-454b-b5e7-736d346731c9","year":2005},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.516674Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:93efead19f29b222869902a3dba26e0a14c4a60b23fa6396d80b620f5a85ad9e","observation_id":"f778d27b-2f1e-44e8-8c59-ca03776ff558","resolution":{"observed_at":"2026-08-12T16:27:35.154150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.137818Z","title":"Wagner and Rudolf Virchowstiftung","venue":null,"work_id":"a095d25b-6afb-42c6-8d24-d62967b5a3f7","year":1921},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.523470Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:d120fbab1737a2aab0945b723b14129d4c31c72e1a213ce3eb003cad8e9b4e8c","observation_id":"dc183ade-47d8-4f75-96de-18e0cdb7d7a2","resolution":{"observed_at":"2026-08-12T16:27:35.141607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.123837Z","title":"Data selection for language models via importance resampling","venue":null,"work_id":"6154e7a9-830e-4dd1-b539-1b7150f5d1e9","year":2023},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.530172Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:c5f97c1469cc02f1788d92f4aa6d157cbc64a981194e15cdc6fcc449e7084b23","observation_id":"8bc23a06-23c0-4d71-adca-5205407e58db","resolution":{"observed_at":"2026-08-12T16:27:35.128450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.110778Z","title":"Inducing multilingual text analysis tools via robust projection across aligned corpora","venue":null,"work_id":"2c88204e-9aea-41b9-b1fa-ebf3d1059a53","year":2001},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.536886Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:d2e436347d052b9cf9b48d117e60baace8fd1dc26ca8358ebf8c59ec25f57480","observation_id":"c70b1709-d956-4a50-9ae3-29974828fd57","resolution":{"observed_at":"2026-08-12T16:27:35.115092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.096840Z","title":"Data collection design for dialogue systems for low-resource languages","venue":null,"work_id":"3dde756a-01a5-4d5b-b46e-daec47e0c2c3","year":2021},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.543460Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:2fa9d7147ec034c132ceb5d031c87d3ccff174309670839152ee05e4578ded71","observation_id":"a646c50a-c68c-4cfd-b7e5-b7a9b5ebb30a","resolution":{"observed_at":"2026-08-12T16:27:35.101417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T16:27:35.081513Z","title":"Machine translation with large language models: Prompting, few-shot learning, and fine-tuning with qlora","venue":null,"work_id":"8f6f4b48-4167-4990-8151-bcaf7f08dc1f","year":2023},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.548405Z"},"links":{"citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:9a45387d6d7ec3508be7d4ec2b01ce2d29e483e2541934a3ba036e8dc0cf06d3","observation_id":"7caba8c4-488c-473f-aa3f-01e37d52c09d","resolution":{"observed_at":"2026-08-12T16:27:35.086935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15061","last_updated":"2024-12-17T12:45:20Z","snapshot_observed_at":"2026-08-16T14:16:02.829397Z","submitted_at":"2024-02-23T02:24:15Z","title":"Fine-tuning Large Language Models for Domain-specific Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15061","snapshot_observed_at":"2026-08-12T16:27:34.553245Z","title":"Fine-tuning large language models for domain-specific machine translation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.553245Z"},"links":{"cited_paper":"/paper/2402.15061","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:5e256657d889bd2441cc1f17b570b8079c45b360e0623a0d7980f7c3839ee313","observation_id":"06d306f8-66d3-473b-8938-90a8af50e61b","resolution":{"observed_at":"2026-08-12T16:27:34.553245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.02201","last_updated":"2016-04-08T00:16:35Z","snapshot_observed_at":"2026-08-14T22:02:35.237315Z","submitted_at":"2016-04-08T00:16:35Z","title":"Transfer Learning for Low-Resource Neural Machine Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.02201","snapshot_observed_at":"2026-08-12T16:27:34.558239Z","title":"Transfer learning for low-resource neural machine translation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T16:27:34.558239Z"},"links":{"cited_paper":"/paper/1604.02201","citing_paper":"/paper/2411.13453"},"observation_digest":"sha256:000e50fa4e882f98fc5ddfc3cfed6bbc162a6c31c74c0caae7d76f21a3d6146e","observation_id":"2317cd0c-d392-45cd-bc47-4e02d968148f","resolution":{"observed_at":"2026-08-12T16:27:34.558239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.13453","last_updated":"2024-11-20T16:59:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T09:39:08.444218Z","submitted_at":"2024-11-20T16:59:41Z","title":"LIMBA: An Open-Source Framework for the Preservation and Valorization of Low-Resource Languages using Generative Models"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":10,"verified_fuzzy":40},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2411.13453."}