{"as_of":"2026-08-08T05:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9bb91f429bd0cddb4b45889eb98569493f0a1c916a12cea07777b5a9ddf524ac","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:49:14.772717Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20888/citation-record","integrity":"/paper/2505.20888/integrity","json":"/paper/2505.20888/citation-record.json","paper":"/paper/2505.20888"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T13:49:10.576691Z","title":"Bowman, Zac Hatfield - Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:10.576691Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:6da66613764033450c791244313473ffc5721e6f2e85d7c96699bcc97375ec48","observation_id":"16700cb5-52df-48e3-b2e1-661b9bd6caa4","resolution":{"observed_at":"2026-08-07T13:49:10.576691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10937","last_updated":"2025-05-16T07:15:30Z","snapshot_observed_at":"2026-08-07T15:44:49.004743Z","submitted_at":"2025-05-16T07:15:30Z","title":"Reasoning with OmniThought: A Large CoT Dataset with Verbosity and Cognitive Difficulty Annotations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10937","snapshot_observed_at":"2026-08-07T13:49:10.708258Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:10.708258Z"},"links":{"cited_paper":"/paper/2505.10937","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:570e9aac2b32448b2bec987830d5d2ce3260e96bcc2f1b93e6ef6be4d766ed19","observation_id":"2ed727d5-12e6-49e6-92af-818187f58d14","resolution":{"observed_at":"2026-08-07T13:49:10.708258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:10.821117Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:10.821117Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:97dd4f4e2cb918f989fbcaec9ecca7ce661b30694c86f698c43c2c546f4bbf49","observation_id":"f81d7848-dedd-4e5f-8d38-42c479cf090d","resolution":{"observed_at":"2026-08-07T13:49:10.821117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:49:10.936159Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:10.936159Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:1a22065acc7c5e23be2ed08bbca560b0897ff5da8e85d94a9fc3e5126799c1b6","observation_id":"1a7806b3-32ad-4d55-96f3-a40792272954","resolution":{"observed_at":"2026-08-07T13:49:10.936159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.927466Z","title":null,"venue":null,"work_id":"e3204668-1742-4c1c-b3ec-73ef1d77d569","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.039656Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:7a9d78708dc3e515e0241ab44d02dc89db171cb7117807cb622e51053fa8a944","observation_id":"fa86540f-742b-46d2-95d0-43310a7c215d","resolution":{"observed_at":"2026-08-07T13:49:17.049312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:11.146637Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.146637Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:b302b3179779645a25feb1d2445c8c2154088f665bcf27ff3eff39c850ad19a6","observation_id":"118f8432-2c75-4acc-b9d3-9b08a70821b6","resolution":{"observed_at":"2026-08-07T13:49:11.146637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.718402Z","title":null,"venue":null,"work_id":"a5719e7e-38b3-4291-8710-3fd8c68b3801","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.336891Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:9ebd0faa825a90d1605b65de4c99f6d903a19dddbc519bd44b084738e27e41f1","observation_id":"7f164466-d777-412c-8b34-6b4fa2a86cc0","resolution":{"observed_at":"2026-08-07T13:49:16.831464Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17419","snapshot_observed_at":"2026-08-07T13:49:11.506083Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.506083Z"},"links":{"cited_paper":"/paper/2502.17419","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:20f7ac68dfa4087d77ef96daf901994b9b1ec03984f1a6c117a34fce93ebb662","observation_id":"e1ac570d-7d18-4e3d-a5fb-9e74697fee98","resolution":{"observed_at":"2026-08-07T13:49:11.506083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07503","last_updated":"2024-08-10T20:46:47Z","snapshot_observed_at":"2026-07-06T17:58:39.485508Z","submitted_at":"2024-04-11T06:34:17Z","title":"Best Practices and Lessons Learned on Synthetic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07503","snapshot_observed_at":"2026-08-07T13:49:11.631956Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.631956Z"},"links":{"cited_paper":"/paper/2404.07503","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:cf3e403976223ae9858de80a45239d9929b6c4fb36e3c8178dd6d3096012dede","observation_id":"d84f3036-e691-4941-86c6-bafdc213e8b4","resolution":{"observed_at":"2026-08-07T13:49:11.631956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.550665Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":"c5df924e-b15e-4eda-bc0f-603c7c6c93c7","year":2023},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.753762Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:f258d6f0db0f51bb8ab4449d653b75a0f262a8acb0d5bb55d8649d6d171925ce","observation_id":"1eb0f43c-616d-417b-a619-9c4b14516ea7","resolution":{"observed_at":"2026-08-07T13:49:16.639299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:11.919425Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:11.919425Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:fe398d4446c942416c13fd6dc4b1480fb45a1229b37487f686332cc51745b816","observation_id":"b236ef97-9d7c-40b8-a083-32f3b56c269b","resolution":{"observed_at":"2026-08-07T13:49:11.919425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:49:12.102333Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.102333Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:3d9b475b914c994af59d112faede14904ee229aa083c8b79be221901bfc4be73","observation_id":"976026f3-de9d-45e1-b810-f06952db3ba1","resolution":{"observed_at":"2026-08-07T13:49:12.102333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T13:49:12.273736Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.273736Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:a14f006f8157fbec172116e27f3fadd6e78f1c966e654e9f0e0380da9b76b843","observation_id":"fffb7907-e84a-46d0-9175-a089dd5ad329","resolution":{"observed_at":"2026-08-07T13:49:12.273736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:12.414602Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.414602Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:1c05b73f4149402afabd3daa13f464845d759c0a759f502abafd4b3bda7a9d13","observation_id":"2a308b24-902e-4d84-9660-d86d4831ed5e","resolution":{"observed_at":"2026-08-07T13:49:12.414602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16944","last_updated":"2023-10-25T19:25:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-25T19:25:16Z","title":"Zephyr: Direct Distillation of LM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16944","snapshot_observed_at":"2026-08-07T13:49:12.573358Z","title":"Rush, and Thomas Wolf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.573358Z"},"links":{"cited_paper":"/paper/2310.16944","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:fc531a082f9927044dc8228945203f6364b7e4f694f6affc4d1e554dd5aa6ddb","observation_id":"03dc10a3-6b99-4af4-88c5-0b6ff0967232","resolution":{"observed_at":"2026-08-07T13:49:12.573358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15027","last_updated":"2025-04-21T11:26:02Z","snapshot_observed_at":"2026-08-07T18:39:51.710621Z","submitted_at":"2025-04-21T11:26:02Z","title":"DistilQwen2.5: Industrial Practices of Training Distilled Open Lightweight Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15027","snapshot_observed_at":"2026-08-07T13:49:12.683332Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.683332Z"},"links":{"cited_paper":"/paper/2504.15027","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:e152395430f383102f867e2628baf0cca00451b76584336ed2c0c1fe93a1e065","observation_id":"35b5faeb-9949-487f-a486-51f21beaea05","resolution":{"observed_at":"2026-08-07T13:49:12.683332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.417275Z","title":"Chi, Quoc V","venue":null,"work_id":"d2524da2-c425-480e-8017-66a6ce9a04ad","year":2022},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.836869Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:bff9f4bd541e7884a2598c77d9875d2342124bba845612a8b105a80cfad69023","observation_id":"b9739006-5b91-4e72-b1bc-506ed69cd7f9","resolution":{"observed_at":"2026-08-07T13:49:16.481426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.252374Z","title":null,"venue":null,"work_id":"8468a842-e5fa-4d6c-969f-b6456f07df67","year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:12.956291Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:94caaa847694d987e402835d01384513b441b6e1c528fe847a3fffa74f35dcc9","observation_id":"674397f2-cf8d-4c36-a775-34275ff0d1a1","resolution":{"observed_at":"2026-08-07T13:49:16.357067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-07T13:49:13.090649Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.090649Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:55ec114e23be16a4c0f232ced610488382d3ae816fadf4eabd422fe379199d63","observation_id":"54ff02cb-bbb5-474f-93c7-ff766aaa3c3b","resolution":{"observed_at":"2026-08-07T13:49:13.090649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:13.241749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.241749Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:d72f8f91983d352b3fa51417c1c61162db1c5ccf2a8711bb426d7abed8660934","observation_id":"27352e52-d305-4679-b675-35efd21778b1","resolution":{"observed_at":"2026-08-07T13:49:13.241749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T13:49:13.426600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.426600Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:8970ff732f143812e85020efaabe58b41cdea7b1ec90583f26da8a2e09bb040d","observation_id":"f70c3008-71eb-4d6e-b1ba-fab0347f83c1","resolution":{"observed_at":"2026-08-07T13:49:13.426600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:49:13.553692Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.553692Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:485cbae1e14d06328cb25f2f19b6ba0fdc7bff00bfeb5481d85a81fb892f5a70","observation_id":"49ddbf71-4d46-4609-a95e-5e4759d5f5fd","resolution":{"observed_at":"2026-08-07T13:49:13.553692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01885","last_updated":"2024-07-02T02:14:42Z","snapshot_observed_at":"2026-08-04T23:46:16.318107Z","submitted_at":"2024-07-02T02:14:42Z","title":"Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01885","snapshot_observed_at":"2026-08-07T13:49:13.665992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.665992Z"},"links":{"cited_paper":"/paper/2407.01885","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:6c5fa443ca1bfade8421bdd77cb83f9d086912631cd805b73e466a49caffb782","observation_id":"db07e64c-29b4-46d0-a1af-2158d955cfe2","resolution":{"observed_at":"2026-08-07T13:49:13.665992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:16.071400Z","title":null,"venue":null,"work_id":"e5bc91e1-f46e-4714-beed-ba4b320b9cdd","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.836889Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:4c55ff25939268320c91239553f7e0262bc9be37aa6afff3438c8badcb3d9fc1","observation_id":"580a2874-3e12-42f8-a6b0-3ef4c55fe26c","resolution":{"observed_at":"2026-08-07T13:49:16.169548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:13.973173Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:13.973173Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:80231b6af9c9c211aef7e56cc7c85ce849b9e9d77106c320546bc4ad9da3d5b3","observation_id":"228b6563-f4f5-40bc-9200-a35b7d1767d1","resolution":{"observed_at":"2026-08-07T13:49:13.973173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04871","last_updated":"2024-12-06T09:04:12Z","snapshot_observed_at":"2026-07-06T20:02:39.525801Z","submitted_at":"2024-12-06T09:04:12Z","title":"Building a Family of Data Augmentation Models for Low-cost LLM Fine-tuning on the Cloud","version":1},"cited_work":{"arxiv_id":"2412.04871","doi":"10.48550/arxiv.2412.04871","metadata_source":"pith","pith_arxiv_id":"2412.04871","snapshot_observed_at":"2026-08-07T18:16:16.850658Z","title":"Building a Family of Data Augmentation Models for Low-cost LLM Fine-tuning on the Cloud","venue":"cs.CL","work_id":"d263ea62-9986-4c92-8d08-1a202781a63e","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.094188Z"},"links":{"cited_paper":"/paper/2412.04871","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:b59605a743526aace32205fb9af2f474ee23079d405d20ab652437e6602a1b5e","observation_id":"1b274687-4f42-416a-b883-8476e822b0f9","resolution":{"observed_at":"2026-08-07T13:49:15.072251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:15.776333Z","title":null,"venue":null,"work_id":"a4fe14a0-7f2a-40b1-a501-7c49a014be02","year":2024},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.300830Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:74f4f1dc055d470b980b2aa406f4c4906887be2bed592b4ac73891e845e07d16","observation_id":"c1262863-ead0-402f-b1a9-6565640fcc69","resolution":{"observed_at":"2026-08-07T13:49:15.882474Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T13:49:14.435037Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.435037Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:484d54a2093b16fe1ec07b0dd2a0c23c97ef6204dd7e9bea48971df773dff68b","observation_id":"045922c6-59f8-45f6-a405-8785e5df4693","resolution":{"observed_at":"2026-08-07T13:49:14.435037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:14.619474Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.619474Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:c3a9861640ace892eb5916f26ca4d5e93405ac38cddb958c9f9d10f262d7e7bf","observation_id":"c3c5d5a9-bc1e-43d7-bcad-247e75da49d0","resolution":{"observed_at":"2026-08-07T13:49:14.619474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:14.772717Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:49:14.772717Z"},"links":{"citing_paper":"/paper/2505.20888"},"observation_digest":"sha256:4ec8674129258ff942e3fecb403803cc1aed8fa73f2ee3a23fb3489107c1dcd8","observation_id":"8fb392f9-069a-4b04-8839-66996858dcf0","resolution":{"observed_at":"2026-08-07T13:49:14.772717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20888","last_updated":"2025-06-27T07:59:43Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T13:42:55.596808Z","submitted_at":"2025-05-27T08:32:51Z","title":"EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2505.20888."}