{"as_of":"2026-08-20T02:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa92fe8a4a0934f56c58ef2ec318c71de26f542db44ae921a295d0a2b3a0142c","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:26:30.412607Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.13227/citation-record","integrity":"/paper/2504.13227/integrity","json":"/paper/2504.13227/citation-record.json","paper":"/paper/2504.13227"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.587060Z","title":null,"venue":null,"work_id":"fb89f7dc-de13-47da-b23a-5c3a27b90197","year":null},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.376683Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:330110df5e3e72c43433b89fc5b1088f27c93a9b49958436c87abc0d06f883aa","observation_id":"b9b11e3e-f976-4a9a-a36d-a28ac492130e","resolution":{"observed_at":"2026-08-16T12:26:30.592641Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.567215Z","title":null,"venue":null,"work_id":"a239f3fe-4c8a-4d31-922f-ef6ad0a269c2","year":null},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.384537Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:f8d9a9266baea47b79bc203ee192a842184479d19dc3844ec628bc2d125a54ab","observation_id":"e87ea6fb-320b-45e5-bf6d-0c25ac846b95","resolution":{"observed_at":"2026-08-16T12:26:30.572605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.549189Z","title":"The projection matrixR∈ Rh×s is constructed as follows:","venue":null,"work_id":"66879978-2a27-44fb-87b0-706213e02f28","year":null},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.390390Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:28c4be33d571109f82a7a796f79dad0072d687a242a8939991117b08842c407a","observation_id":"7ac9b085-ad4d-4abf-9c0b-fa57e39c8de3","resolution":{"observed_at":"2026-08-16T12:26:30.554750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.605696Z","title":"In ACL, Bangkok, Thailand","venue":null,"work_id":"e1418801-de3c-47b5-b4cc-2edf7388a246","year":2024},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.370804Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:8ec4b0fb88bd7b4a10f213c50bab74383bf2c59187f7cf322538bc9a2939a60b","observation_id":"2e211b5f-5de3-4890-82ab-2083c342d6a5","resolution":{"observed_at":"2026-08-16T12:26:30.611494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.530840Z","title":null,"venue":null,"work_id":"f7ec2793-3c12-4506-a2a4-d50ad14f9572","year":null},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.396378Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:71d5c1cd69acffe6984826bb5407dacf50883237b089f7a0c1defba750764c77","observation_id":"bcf63122-0cec-4289-b337-a66aac454407","resolution":{"observed_at":"2026-08-16T12:26:30.537095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.511613Z","title":null,"venue":null,"work_id":"a7b383f7-d403-439c-8b6e-314c48b0f94f","year":null},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.403169Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:d3250bab79ad3492f6978ac9f2e2cafde1a0575e05fb892621d215a8da6359d0","observation_id":"b4fcb583-a84f-4a7f-9584-b6007b8c2c78","resolution":{"observed_at":"2026-08-16T12:26:30.517754Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.492933Z","title":"DIDS automates this process and im- proves upon static optimal ratios through dynamic adaptation","venue":null,"work_id":"e9221fd8-8c77-4c24-9dda-c6e332786d48","year":2023},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.412607Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:f6c841710f0a0985869cd25c49dc8d9023edfc19fce2ee6d1fc303c333f19378","observation_id":"98bf748c-7fb0-4cfc-9029-6cd2a10f76e4","resolution":{"observed_at":"2026-08-16T12:26:30.498599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.623887Z","title":"Sung Min Park, Kristian Georgiev, Andrew Ilyas, Guil- laume Leclerc, and Aleksander Madry","venue":null,"work_id":"b9e390df-aa1b-412c-82a0-0a6b581df952","year":2023},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":323,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.364676Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:4720ded249b6547b48f684afc0e0e2f7ec3e0e4ebd4c6a2e647ea7996c51ee38","observation_id":"1ecb0dff-0aa9-45c3-82c8-7edd538dfd5b","resolution":{"observed_at":"2026-08-16T12:26:30.630084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.661831Z","title":null,"venue":null,"work_id":"4f828ca3-e8fa-429b-84bf-e36459b1e57f","year":2019},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.352249Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:37e29af2b331577c2d2010681927e3cc5dc927f816ff40beb1c20299ea3ad0d1","observation_id":"bff56ed7-9d75-4470-b6cc-7bc4dc657c0c","resolution":{"observed_at":"2026-08-16T12:26:30.668196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.681408Z","title":"Yuan Ge, Yilun Liu, Chi Hu, Weibin Meng, Shimin Tao, Xiaofeng Zhao, Hongxia Ma, Li Zhang, Box- ing Chen, Hao Yang, et al","venue":null,"work_id":"225b4081-9693-489d-b9a2-c1e6daf22b6b","year":2024},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.345253Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:843deef0e2ef033c6648442f38819da852a72fe19f6ba63850f5e28a63093850","observation_id":"d26ebb08-2145-4a37-8ee5-4e0745961a76","resolution":{"observed_at":"2026-08-16T12:26:30.688540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:26:30.642437Z","title":"In ECCV, pages 304–","venue":null,"work_id":"f1b42370-1345-42c3-b49f-40be2636865d","year":null},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.358029Z"},"links":{"citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:a818d49fca21f612502f99d21bba1ba4ea3f53afd95e96db26b811da0cfd910f","observation_id":"4100b799-a1f9-4bed-9381-26a3f7a7c80c","resolution":{"observed_at":"2026-08-16T12:26:30.648356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14055","last_updated":"2025-05-27T02:52:03Z","snapshot_observed_at":"2026-08-15T22:52:22.722574Z","submitted_at":"2024-11-21T12:02:39Z","title":"DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization","version":2},"cited_work":{"arxiv_id":"2411.14055","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.14055","snapshot_observed_at":"2026-08-16T12:26:30.466236Z","title":"DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization","venue":"cs.CL","work_id":"19348767-5252-4ed6-8d3b-fa64708b2e7b","year":2024},"citing_paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training","version":2},"reference_index":2430,"source":"pdf_text","source_observed_at":"2026-08-16T12:26:30.338427Z"},"links":{"cited_paper":"/paper/2411.14055","citing_paper":"/paper/2504.13227"},"observation_digest":"sha256:ca97c74e3b8332d55b25658085019c7de4d797014ee3e6423ff5bea8ee0f1255","observation_id":"f95f503c-6ffe-4f13-98ff-280d77561d65","resolution":{"observed_at":"2026-08-16T12:26:30.478501Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.13227","last_updated":"2025-08-22T11:26:53Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T12:17:28.511790Z","submitted_at":"2025-04-17T13:09:38Z","title":"DIDS: Domain Impact-aware Data Sampling for Large Language Model Training"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2504.13227."}