{"as_of":"2026-07-25T02:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f464457e900adbf4bde0b0f7ef774b467c4ecb4c9a9f62cfe220ee128c60fc56","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-24T06:31:00.690269+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T14:42:55.368104Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-07-06T14:33:16.914984Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":"2212.10670","doi":"10.48550/arxiv.2212.10670","metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2212.10670 , year=","venue":null,"work_id":"22324127-13ca-467a-9214-684608eb4b92","year":2022},"citing_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-17T23:31:11.213552Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2402.13116"},"observation_digest":"sha256:49a184ed88e9bf940ca8c8f35817c52ccc0558eb91fe601ff2f4de27f085fc6f","observation_id":"351aa1f1-8960-4d65-8190-096a3142cf8d","resolution":{"observed_at":"2026-05-17T23:31:11.619407Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-07-06T14:33:16.914984Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":"2212.10670","doi":"10.48550/arxiv.2212.10670","metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2212.10670 , year=","venue":null,"work_id":"22324127-13ca-467a-9214-684608eb4b92","year":2022},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:f3485e58a895e65a806184a77a39cabaa6bd7c25542f6cf994ca408305d02b55","observation_id":"8f161929-3086-4a8d-b908-e69d41ac0840","resolution":{"observed_at":"2026-05-15T02:39:33.422880Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-07-06T14:33:16.914984Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":"2212.10670","doi":"10.48550/arxiv.2212.10670","metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2212.10670 , year=","venue":null,"work_id":"22324127-13ca-467a-9214-684608eb4b92","year":2022},"citing_paper":{"arxiv_id":"2604.07941","last_updated":"2026-04-16T04:43:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T08:00:37Z","title":"Large Language Model Post-Training: A Unified View of Off-Policy and On-Policy Learning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T18:28:58.515666Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2604.07941"},"observation_digest":"sha256:d896b91bab03cbccee082036ba776dcc9f7b3f36228f724c8b338d57d59c0756","observation_id":"472c5697-fbce-427e-a6ea-a73f4fe20b73","resolution":{"observed_at":"2026-05-11T00:30:53.891992Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-07-06T14:33:16.914984Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":"2212.10670","doi":"10.48550/arxiv.2212.10670","metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2212.10670 , year=","venue":null,"work_id":"22324127-13ca-467a-9214-684608eb4b92","year":2022},"citing_paper":{"arxiv_id":"2604.26573","last_updated":"2026-04-29T11:56:07Z","snapshot_observed_at":"2026-07-06T23:12:10.599132Z","submitted_at":"2026-04-29T11:56:07Z","title":"PAINT: Partial-Solution Adaptive Interpolated Training for Self-Distilled Reasoners","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T11:21:32.507041Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2604.26573"},"observation_digest":"sha256:f7d867fa2213fc0b3021765440fda5b8cd8f997874ff0302abe0716d6fe9b8b4","observation_id":"28641ed8-1c1b-47be-99d6-7f1a31a57fd3","resolution":{"observed_at":"2026-05-09T03:55:08.448617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-07-06T14:33:16.914984Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":"2212.10670","doi":"10.48550/arxiv.2212.10670","metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2212.10670 , year=","venue":null,"work_id":"22324127-13ca-467a-9214-684608eb4b92","year":2022},"citing_paper":{"arxiv_id":"2605.07783","last_updated":"2026-05-08T14:21:05Z","snapshot_observed_at":"2026-07-06T23:20:06.574823Z","submitted_at":"2026-05-08T14:21:05Z","title":"Chain-based Distillation for Effective Initialization of Variable-Sized Small Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-11T03:31:33.964471Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2605.07783"},"observation_digest":"sha256:3e992f652dd21bbfe0b41c138ae4ae6c4e94d7c63d0184ab285adbfc11740ba5","observation_id":"d65d82bd-6755-4345-9668-bc5c0cac8e31","resolution":{"observed_at":"2026-05-11T03:40:54.046222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-07-06T14:33:16.914984Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":"2212.10670","doi":"10.48550/arxiv.2212.10670","metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2212.10670 , year=","venue":null,"work_id":"22324127-13ca-467a-9214-684608eb4b92","year":2022},"citing_paper":{"arxiv_id":"2605.08842","last_updated":"2026-05-09T09:53:03Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T09:53:03Z","title":"XPERT: Expert Knowledge Transfer for Effective Training of Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-12T02:45:17.513513Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2605.08842"},"observation_digest":"sha256:c67cbd5437857c1c557ea61d9873b2493e11781a6b0e4dfa6af921c21b22e1f9","observation_id":"1dec218e-018a-449c-82fd-0b01cbe6fe3b","resolution":{"observed_at":"2026-05-12T02:46:18.779534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-07-06T14:33:16.914984Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":"2212.10670","doi":"10.48550/arxiv.2212.10670","metadata_source":"arxiv_reference","pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2212.10670 , year=","venue":null,"work_id":"22324127-13ca-467a-9214-684608eb4b92","year":2022},"citing_paper":{"arxiv_id":"2605.17497","last_updated":"2026-05-17T15:14:24Z","snapshot_observed_at":"2026-07-06T23:28:30.942078Z","submitted_at":"2026-05-17T15:14:24Z","title":"Self-Supervised On-Policy Distillation for Reasoning Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-20T14:42:55.368104Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2605.17497"},"observation_digest":"sha256:7fecdc6cb0513231631cfca5ad6f2ace2c87f176f53564c28c47c585a1dea643","observation_id":"636e47df-8da1-4552-9799-5cbef328143c","resolution":{"observed_at":"2026-05-20T14:43:21.841999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.827483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2212.10670/citation-record","integrity":"/paper/2212.10670/integrity","json":"/paper/2212.10670/citation-record.json","paper":"/paper/2212.10670"},"outbound":[],"paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T14:33:16.914984Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"thesis":"As of 25 July 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2212.10670."}