{"as_of":"2026-08-08T08:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b81b4cc2e5a1e036c9651a0325d57f0a930fbd7d60e3178c173a24036c10c9b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:04:22.901349Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T06:15:58.988295Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-01T06:32:48.110512Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-07T14:04:22.901349Z","title":"Task-adaptive pretrained language models via clustered-importance sampling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20380","last_updated":"2025-05-26T17:32:14Z","snapshot_observed_at":"2026-08-08T04:26:12.725477Z","submitted_at":"2025-05-26T17:32:14Z","title":"GRAPE: Optimize Data Mixture for Group Robust Multi-target Adaptive Pretraining","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:04:22.901349Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2505.20380"},"observation_digest":"sha256:068d2d00df3ab89c285ff1ade930e5f2a0aa9b7bf7177f7da8a0b7f94c27da03","observation_id":"4514bdcb-4843-496a-b304-2ba5fc63bd0c","resolution":{"observed_at":"2026-08-07T14:04:22.901349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-01T06:32:48.110512Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-07T00:42:57.732570Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12966","last_updated":"2025-06-15T21:08:51Z","snapshot_observed_at":"2026-08-08T07:38:04.871609Z","submitted_at":"2025-06-15T21:08:51Z","title":"Assessing the Role of Data Quality in Training Bilingual Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:57.732570Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2506.12966"},"observation_digest":"sha256:63327d91c74c61e401b2a16c14e6a72ddaf2f53f77a2152a782e04371e8d76f4","observation_id":"74951000-d1e7-44b6-bd03-72c9a584ee1f","resolution":{"observed_at":"2026-08-07T00:42:57.732570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-01T06:32:48.110512Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-06T16:53:10.133518Z","title":"Task-adaptive pretrained language models via clustered-importance sampling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12466","last_updated":"2025-07-16T17:59:45Z","snapshot_observed_at":"2026-08-07T10:43:47.278118Z","submitted_at":"2025-07-16T17:59:45Z","title":"Language Models Improve When Pretraining Data Matches Target Tasks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:53:10.133518Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2507.12466"},"observation_digest":"sha256:6169fd28c4f61220c126866c5f5fc1a3991988f86ac0a3702385ff06e5f9d152","observation_id":"14fd87ce-5af6-49d7-b84b-84a018c74bc3","resolution":{"observed_at":"2026-08-06T16:53:10.133518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-01T06:32:48.110512Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-04T13:24:14.800183Z","title":"Task-adaptive pretrained language models via clustered- importance sampling.arXiv preprint arXiv:2410.03735,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.00866","last_updated":"2026-06-24T09:23:10Z","snapshot_observed_at":"2026-08-08T07:37:11.965093Z","submitted_at":"2025-10-01T13:15:15Z","title":"Removing Noise, not Finding Gold: Quality Filtering for Large-Scale Pretraining","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:24:14.800183Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2510.00866"},"observation_digest":"sha256:290e3be753be86a8de1724b39ce2b8e2a567ad016f97b5dd1ef5d3f774fafceb","observation_id":"c1f66cfd-4456-4ec6-a630-ddb72b9ecda1","resolution":{"observed_at":"2026-08-04T13:24:14.800183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-01T06:32:48.110512Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-08-03T04:17:27.132962Z","title":"Task-adaptive pretrained language models via clustered-importance sampling.arXiv preprint arXiv:2410.03735, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.05547","last_updated":"2026-08-05T16:57:37Z","snapshot_observed_at":"2026-08-08T08:13:03.151575Z","submitted_at":"2026-02-05T11:06:37Z","title":"Multi-Task GRPO: Reliable LLM Reasoning Across Tasks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T04:17:27.132962Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2602.05547"},"observation_digest":"sha256:ebf9f1d254dd7bcd03c5f7ae0dc940bf9de416ea7575e2eb9c61de6668c10cee","observation_id":"7feaa412-33a7-44f7-a1d9-a6d5bbc3e356","resolution":{"observed_at":"2026-08-03T04:17:27.132962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","snapshot_observed_at":"2026-08-01T06:32:48.110512Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling","version":2},"cited_work":{"arxiv_id":"2410.03735","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03735","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Task-adaptive pretrained language models via clustered-importance sampling","venue":null,"work_id":"7dad0764-e693-4d01-adf8-d839d2128171","year":2024},"citing_paper":{"arxiv_id":"2604.08519","last_updated":"2026-04-09T17:55:50Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:55:50Z","title":"Cram Less to Fit More: Training Data Pruning Improves Memorization of Facts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-10T17:42:31.465077Z"},"links":{"cited_paper":"/paper/2410.03735","citing_paper":"/paper/2604.08519"},"observation_digest":"sha256:cb7be271afa2df3aadc944497ff798213b35df4e8314bdc8b470335cb5539e09","observation_id":"c2274be3-db88-4413-88b3-69a1ca1e5520","resolution":{"observed_at":"2026-05-11T06:15:58.990203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.03735/citation-record","integrity":"/paper/2410.03735/integrity","json":"/paper/2410.03735/citation-record.json","paper":"/paper/2410.03735"},"outbound":[],"paper":{"arxiv_id":"2410.03735","last_updated":"2025-03-11T00:20:30Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-01T06:32:48.110512Z","submitted_at":"2024-09-30T20:49:54Z","title":"Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2410.03735."}