{"as_of":"2026-08-11T17:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:587d6c65b805e3d5a0d7ffb78762fea251fe9bb17e3c17fb9a33e9091160acd4","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:49:32.290699Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.03826/citation-record","integrity":"/paper/2501.03826/integrity","json":"/paper/2501.03826/citation-record.json","paper":"/paper/2501.03826"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:49:32.219932Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.219932Z"},"links":{"citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:fb44d142ccfa0670f9bec0f689e52dcccf24ac89d91d71b3852463104d267a00","observation_id":"022ea559-4547-430a-9882-d87cf8325cd1","resolution":{"observed_at":"2026-08-10T21:49:32.219932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:49:32.225622Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.225622Z"},"links":{"citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:8e2483b3caf06b78bb37c6ee6bdb4aa529c8eed8db84f023c1a4e767f38e10e3","observation_id":"5f32381a-64f2-49a7-81db-a394ff527064","resolution":{"observed_at":"2026-08-10T21:49:32.225622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16827","last_updated":"2024-08-02T17:59:31Z","snapshot_observed_at":"2026-08-03T03:15:21.035418Z","submitted_at":"2024-02-26T18:54:35Z","title":"A Survey on Data Selection for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16827","snapshot_observed_at":"2026-08-10T21:49:32.230472Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.230472Z"},"links":{"cited_paper":"/paper/2402.16827","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:c5c3afb0ed64a2e3450b942f5d7b37637f3e837900d8a204de4061c8280c5fb0","observation_id":"21a5bb3e-e817-40a5-969e-8980509f53f2","resolution":{"observed_at":"2026-08-10T21:49:32.230472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-10T21:49:32.235627Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.235627Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:7fe17addb6d90bc8f1ae94acb6ddb6fc1f3aacb336fc782894b1d00d78217226","observation_id":"3494af29-6327-40c2-bb2b-ed0d6a85f2fe","resolution":{"observed_at":"2026-08-10T21:49:32.235627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-10T21:49:32.239877Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.239877Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:a2d491a2efa9d8d3f538f5441f967321dc72da89ed7876326019546c50ac40f7","observation_id":"239a1845-ca03-4a8a-957f-88f548584989","resolution":{"observed_at":"2026-08-10T21:49:32.239877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11719","last_updated":"2023-07-09T21:53:45Z","snapshot_observed_at":"2026-08-07T21:40:40.556424Z","submitted_at":"2022-07-24T11:23:31Z","title":"Gradient-based Bi-level Optimization for Deep Learning: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11719","snapshot_observed_at":"2026-08-10T21:49:32.245069Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.245069Z"},"links":{"cited_paper":"/paper/2207.11719","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:b6b604200701504c7d50555430ad01c61708d9d087b31eb03941be4ead91d3d6","observation_id":"7a4fe3c5-57ca-4a87-bcc6-1536ca43ad24","resolution":{"observed_at":"2026-08-10T21:49:32.245069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:49:32.474635Z","title":null,"venue":null,"work_id":"6bfb88db-e62f-489f-a6b3-eabc1f969856","year":2021},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.250611Z"},"links":{"citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:0b1f10e1e69454d8c1f5b9e606f8944e25374f4cb15d623b486124337739d1d2","observation_id":"8d2d8e1a-85ae-44e4-b16a-1bde8b52f8f3","resolution":{"observed_at":"2026-08-10T21:49:32.479451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-10T21:49:32.255398Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.255398Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:b9601853953e093e11a11d85e866baf9235aab6a0b7c630791b038cfd87659c8","observation_id":"9d9a4bc8-fc65-44a1-acd1-3cbbaeda5c5e","resolution":{"observed_at":"2026-08-10T21:49:32.255398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10964","last_updated":"2020-05-05T22:00:44Z","snapshot_observed_at":"2026-08-02T02:53:18.136026Z","submitted_at":"2020-04-23T04:21:19Z","title":"Don't Stop Pretraining: Adapt Language Models to Domains and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10964","snapshot_observed_at":"2026-08-10T21:49:32.260531Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.260531Z"},"links":{"cited_paper":"/paper/2004.10964","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:31076f7a71d506fbd7c9f37a09037bcaf851d079e5735515c0aebc4e08a53116","observation_id":"eab36d1d-707f-402c-bf70-e98bedcfaa88","resolution":{"observed_at":"2026-08-10T21:49:32.260531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:49:32.266611Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.266611Z"},"links":{"citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:9ab348912633dfa666103afb145fd873c002e17bb719b873d53f09fb8bd02bdf","observation_id":"3135496d-87e3-480f-a679-a225496398c1","resolution":{"observed_at":"2026-08-10T21:49:32.266611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-10T21:49:32.271065Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.271065Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:723447a5fb4a6d248ad5083edbe5a280286787c63ce5f53a85caa35659301960","observation_id":"8c41f9fc-4dfc-4113-a92f-3022d9c015a0","resolution":{"observed_at":"2026-08-10T21:49:32.271065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:49:32.455726Z","title":null,"venue":null,"work_id":"37eb0036-8829-46d3-9965-45ccfc03ce20","year":2018},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.275387Z"},"links":{"citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:128554932f9ee4b7be6888b983e344ecb3f550b7bb9c604baaac28c68ebd89bb","observation_id":"042a6e48-3a63-452b-be60-f6e89ccf26f6","resolution":{"observed_at":"2026-08-10T21:49:32.459945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-10T21:49:32.278940Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.278940Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:a82b28f6dd51db1205a6642e62c9734f7ba33d5539d8bf14269e519c4a9903a6","observation_id":"326e4e8e-f9d4-4b96-948f-5081f9855e58","resolution":{"observed_at":"2026-08-10T21:49:32.278940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:49:32.441441Z","title":null,"venue":null,"work_id":"2e6d398f-3608-4821-8aac-35ac4d18d2ca","year":2023},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.282966Z"},"links":{"citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:71e42f59fe44d672195074ed9824050a3c3cca80d5de0e1ed67444f769ec37eb","observation_id":"f520713b-44c9-4956-994a-6a7ff46e5da7","resolution":{"observed_at":"2026-08-10T21:49:32.446891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14781","last_updated":"2025-05-21T03:41:29Z","snapshot_observed_at":"2026-08-11T07:45:36.579555Z","submitted_at":"2024-09-23T07:55:35Z","title":"Pretraining Data Detection for Large Language Models: A Divergence-based Calibration Method","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14781","snapshot_observed_at":"2026-08-10T21:49:32.286703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.286703Z"},"links":{"cited_paper":"/paper/2409.14781","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:b851d3210003d396eb517792bb211fd3ac99ca2fdcd763ea564f6d0816c7f6aa","observation_id":"0a93cd73-86ba-4d1e-9729-1e33082a474d","resolution":{"observed_at":"2026-08-10T21:49:32.286703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10825","last_updated":"2024-09-16T05:09:57Z","snapshot_observed_at":"2026-07-06T18:15:50.255628Z","submitted_at":"2024-05-17T14:46:13Z","title":"Large Language Model (LLM) for Telecommunications: A Comprehensive Survey on Principles, Key Techniques, and Opportunities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10825","snapshot_observed_at":"2026-08-10T21:49:32.290699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T21:49:32.290699Z"},"links":{"cited_paper":"/paper/2405.10825","citing_paper":"/paper/2501.03826"},"observation_digest":"sha256:7fcdc80f5b70eee568e8b51ebc44b0d5d8ba02ad8e1d9030b7add36a1158e4fb","observation_id":"3ee829c9-ff87-488b-9849-4fb2ba4547c7","resolution":{"observed_at":"2026-08-10T21:49:32.290699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.03826","last_updated":"2025-01-07T14:38:49Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T21:44:05.941146Z","submitted_at":"2025-01-07T14:38:49Z","title":"Investigating the Impact of Data Selection Strategies on Language Model Performance"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2501.03826."}