{"as_of":"2026-08-22T17:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dd2801636177fa45295ebcfd117cf20c02f3535aaf507651c57ec06469552cbb","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:08:07.738729Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T23:44:57.222772Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T23:45:30.651091Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"cited_work":{"arxiv_id":"2501.14506","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14506","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"我们现在有4个月大没有糖尿病的老鼠，但它们曾经得过该病。","venue":null,"work_id":"bafb38dc-5031-4840-ac11-fc9eebe5c6bc","year":2020},"citing_paper":{"arxiv_id":"2511.07003","last_updated":"2026-04-24T12:40:52Z","snapshot_observed_at":"2026-07-06T22:35:22.282985Z","submitted_at":"2025-11-10T11:54:53Z","title":"NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T23:44:57.222772Z"},"links":{"cited_paper":"/paper/2501.14506","citing_paper":"/paper/2511.07003"},"observation_digest":"sha256:590a283fc3ec0c2e17592bc7cf03f7e2e80ab3c489f24157dc7e4f553f270e0b","observation_id":"a374fd8b-b441-4453-b49e-e3931dd95fd7","resolution":{"observed_at":"2026-05-17T23:45:30.653953Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14506/citation-record","integrity":"/paper/2501.14506/integrity","json":"/paper/2501.14506/citation-record.json","paper":"/paper/2501.14506"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:08:07.680478Z","title":"Internlm: A multilingual language model with progressively enhanced capabilities, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.680478Z"},"links":{"citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:841d22f861c9dc1200843bfcbbba0f8ad9ef73a21f9390074eb7c443bfb185f1","observation_id":"0149180a-3dc2-4e23-a8aa-0a91d1698aa9","resolution":{"observed_at":"2026-08-10T15:08:07.680478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:08:07.925147Z","title":"Ccnet: Extracting high quality monolingual datasets from web crawl data, 2019","venue":null,"work_id":"104147bf-9707-4951-a856-e9186f1448d1","year":2019},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.685625Z"},"links":{"citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:c0347dfb756b17c9e040146fd5d7dd85418b61cd4c6ba6ff862eabe50c0ac5c1","observation_id":"721c45b8-bc74-434e-b114-f233afb69c24","resolution":{"observed_at":"2026-08-10T15:08:07.930027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T15:08:07.690126Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.690126Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:278963fe17b4c686c21bdda00ce8712b8c9204f83bc3049d30db22cb9462cf7d","observation_id":"e10e8ec0-60b5-4fa6-85bd-39e2ea101f78","resolution":{"observed_at":"2026-08-10T15:08:07.690126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:08:07.911710Z","title":"Choquette-Choo, Katherine Lee, Derrick Xin, Aditya Kusupati, Romi Stella, Ankur Bapna, and Orhan Firat","venue":null,"work_id":"6bdeaa3c-a1ff-4683-9e7e-14f78b11e056","year":2023},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.695203Z"},"links":{"citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:eb7f606eb4879bf531986b3be0c1899206a4f74951d82e9587d050bcc8e54c4f","observation_id":"e93e8ff8-aa85-4433-a229-5c5c4f46a7b1","resolution":{"observed_at":"2026-08-10T15:08:07.916078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:08:07.898211Z","title":"mt5: A massively multilingual pre-trained text-to-text trans- former, 2021","venue":null,"work_id":"178c35e1-876a-41c8-9a95-baa4f8290332","year":2021},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.699846Z"},"links":{"citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:4143cc3859c429b8e9c0eab4d4ee603650334a2807ec8d649fde9b48c50d5d56","observation_id":"514070a6-0e20-415d-be51-10e71ffde3f2","resolution":{"observed_at":"2026-08-10T15:08:07.902831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.01759","last_updated":"2016-08-09T17:38:43Z","snapshot_observed_at":"2026-08-16T02:41:53.636308Z","submitted_at":"2016-07-06T19:40:15Z","title":"Bag of Tricks for Efficient Text Classification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.01759","snapshot_observed_at":"2026-08-10T15:08:07.704266Z","title":"Bag of tricks for efficient text classification","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.704266Z"},"links":{"cited_paper":"/paper/1607.01759","citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:85af982cca66b7aecbdf617f03e2f88548962cc17209ed54bbf34bf0a9db7a75","observation_id":"e528d8e3-e732-4f19-b0a7-f653008fb975","resolution":{"observed_at":"2026-08-10T15:08:07.704266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:08:07.885686Z","title":"Fasttext.zip: Compressing text classification models, 2016","venue":null,"work_id":"16bd6ed4-166b-4918-8157-4a93e47def0f","year":2016},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.709262Z"},"links":{"citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:509fd73a1c2d5e362ae0518694ed758842adccc70b41e611c2786012019f275f","observation_id":"01a3bc6a-8cfb-4b84-909b-1b01c1a129fd","resolution":{"observed_at":"2026-08-10T15:08:07.889486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:08:07.713491Z","title":"Deduplicating training data makes language models better, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.713491Z"},"links":{"citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:1f67962176f40d3b225f7f581009c78d387a1eca217dd8c683a11a105bbdab1e","observation_id":"4cf1e75e-b205-4d4d-bdbd-fe0bc48ffd86","resolution":{"observed_at":"2026-08-10T15:08:07.713491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10487","last_updated":"2022-05-21T02:14:27Z","snapshot_observed_at":"2026-08-04T13:21:32.121470Z","submitted_at":"2022-05-21T02:14:27Z","title":"Scaling Laws and Interpretability of Learning from Repeated Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10487","snapshot_observed_at":"2026-08-10T15:08:07.717723Z","title":"Scaling laws and interpretability of learning from repeated data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.717723Z"},"links":{"cited_paper":"/paper/2205.10487","citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:4e077171e59244048ca9f851c76f75b1f0e8775b4858106f9af15e9fef807641","observation_id":"1d223ae8-33dc-4701-9315-20d42d192dbf","resolution":{"observed_at":"2026-08-10T15:08:07.717723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:08:07.863107Z","title":"On the resemblance and containment of documents","venue":null,"work_id":"a805fca2-a4f8-4eac-b459-7ff23b6b1b2e","year":1997},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.722121Z"},"links":{"citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:2964dd8275423eb72137feaeb7b90eaa3ea9c65b4e2acf67d9a805e1a7461a5e","observation_id":"f0a8b481-4f0f-409c-b5e7-d732d19823fc","resolution":{"observed_at":"2026-08-10T15:08:07.868159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:08:07.849640Z","title":"Kenlm: Faster and smaller language model queries","venue":null,"work_id":"9ee62661-c293-4649-b450-d05b9eb6abfe","year":2011},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.726160Z"},"links":{"citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:1594e533b941f40cfba74099a408666d8c25d886eba422cab500febc5d80a58a","observation_id":"9bfd8bba-a2ac-4e4f-afba-7ec1ab2e8f41","resolution":{"observed_at":"2026-08-10T15:08:07.854282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T15:08:07.729845Z","title":"BERT: pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.729845Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:9754d639a76bdc39614ed3f4eca8a51a9431e728d1b5fe479ca3a2b20b66d44d","observation_id":"02b69b7b-ec91-45bd-abda-a21b77b1dade","resolution":{"observed_at":"2026-08-10T15:08:07.729845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02116","last_updated":"2020-04-08T01:02:17Z","snapshot_observed_at":"2026-08-16T12:39:33.749100Z","submitted_at":"2019-11-05T22:42:00Z","title":"Unsupervised Cross-lingual Representation Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02116","snapshot_observed_at":"2026-08-10T15:08:07.734340Z","title":"Unsupervised cross-lingual representation learning at scale","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.734340Z"},"links":{"cited_paper":"/paper/1911.02116","citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:c7af86679439486364f97af64a06fe2345530c7478921ad848eff7d86c572493","observation_id":"6550433f-077c-4613-a6c0-aec1ab197aea","resolution":{"observed_at":"2026-08-10T15:08:07.734340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:08:07.834162Z","title":"Enriching word vectors with subword information, 2017","venue":null,"work_id":"55b8f186-c453-4216-9fee-c65c6435fe7c","year":2017},"citing_paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T15:08:07.738729Z"},"links":{"citing_paper":"/paper/2501.14506"},"observation_digest":"sha256:243683f78a76555c2abacbea1fd5a20362ed6ff97f4f3afe283b4081f517b084","observation_id":"97a047a4-2f55-4828-b9a8-602c9b55d66d","resolution":{"observed_at":"2026-08-10T15:08:07.840137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.14506","last_updated":"2025-01-24T14:06:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T12:43:40.396191Z","submitted_at":"2025-01-24T14:06:29Z","title":"WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 1 inbound Pith citation observation for arXiv:2501.14506."}