{"as_of":"2026-08-04T09:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22a037f2dfd3b179f88d99e8685379ea6f17a49be3668f0f3a9bbe6cbef0aeca","coverage":[{"denominator":4,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T20:35:27.085495Z","state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.03110/citation-record","integrity":"/paper/2604.03110/integrity","json":"/paper/2604.03110/citation-record.json","paper":"/paper/2604.03110"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Association for Computational Linguistics","venue":null,"work_id":"a3da44b4-2a95-4109-b272-789dcb667efd","year":2020},"citing_paper":{"arxiv_id":"2604.03110","last_updated":"2026-04-03T15:35:07Z","snapshot_observed_at":"2026-07-06T22:52:20.577677Z","submitted_at":"2026-04-03T15:35:07Z","title":"Multi-Aspect Knowledge Distillation for Language Model with Low-rank Factorization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T20:35:27.085495Z"},"links":{"citing_paper":"/paper/2604.03110"},"observation_digest":"sha256:c58821dae4e044f54dabedca56df817edb6d500d0e54f8436c0eef9ff53af741","observation_id":"0d528f26-c6f6-4e60-9896-6273fa9aa2a2","resolution":{"observed_at":"2026-05-14T01:23:38.746199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.11794","last_updated":"2020-06-23T00:23:39Z","snapshot_observed_at":"2026-07-06T09:00:26.490403Z","submitted_at":"2020-02-26T21:17:13Z","title":"Train Large, Then Compress: Rethinking Model Size for Efficient Training and Inference of Transformers","version":2},"cited_work":{"arxiv_id":"2002.11794","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2002.11794","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv , Author =:2002.11794 , Primaryclass =","venue":null,"work_id":"31207e52-32bb-46c8-8c12-17fcaffef1b1","year":2002},"citing_paper":{"arxiv_id":"2604.03110","last_updated":"2026-04-03T15:35:07Z","snapshot_observed_at":"2026-07-06T22:52:20.577677Z","submitted_at":"2026-04-03T15:35:07Z","title":"Multi-Aspect Knowledge Distillation for Language Model with Low-rank Factorization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T20:35:27.085495Z"},"links":{"cited_paper":"/paper/2002.11794","citing_paper":"/paper/2604.03110"},"observation_digest":"sha256:7ce05f0ffde606c45c7e48a43138634f0b2fee22237ec66fd223e9fcac31a746","observation_id":"b448464b-74a8-40b0-8ca0-e15f4d3bdf7c","resolution":{"observed_at":"2026-05-13T20:38:14.644305Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00593","last_updated":"2021-03-17T06:38:05Z","snapshot_observed_at":"2026-07-06T10:10:39.816933Z","submitted_at":"2020-11-01T18:47:51Z","title":"MixKD: Towards Efficient Distillation of Large-scale Language Models","version":2},"cited_work":{"arxiv_id":"2011.00593","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00593","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chin-Yew Lin","venue":null,"work_id":"61724266-2b75-4df9-991c-5b992a9f3045","year":2020},"citing_paper":{"arxiv_id":"2604.03110","last_updated":"2026-04-03T15:35:07Z","snapshot_observed_at":"2026-07-06T22:52:20.577677Z","submitted_at":"2026-04-03T15:35:07Z","title":"Multi-Aspect Knowledge Distillation for Language Model with Low-rank Factorization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T20:35:27.085495Z"},"links":{"cited_paper":"/paper/2011.00593","citing_paper":"/paper/2604.03110"},"observation_digest":"sha256:6cf2d7d34aa4b881410b6fa6fc5d8a574d5803f94a563e0bc5604d3c19ab5a17","observation_id":"bfd986ba-165a-40a6-9718-8781e7787c40","resolution":{"observed_at":"2026-05-13T20:38:14.647330Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-07-06T06:06:04.571585Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":"1710.09412","doi":"10.48550/arxiv.1710.09412","metadata_source":"pith","pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"mixup: Beyond Empirical Risk Minimization","venue":"cs.LG","work_id":"7f61d5d0-82cd-471c-9ea6-17c31d56d24e","year":2017},"citing_paper":{"arxiv_id":"2604.03110","last_updated":"2026-04-03T15:35:07Z","snapshot_observed_at":"2026-07-06T22:52:20.577677Z","submitted_at":"2026-04-03T15:35:07Z","title":"Multi-Aspect Knowledge Distillation for Language Model with Low-rank Factorization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T20:35:27.085495Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2604.03110"},"observation_digest":"sha256:1e030e6e70f6d4b6fb449750710d9fba5242a83f21eb2e93f0652e274f3a1727","observation_id":"65bd97f0-8e95-4ed5-9ac8-4aef1d780962","resolution":{"observed_at":"2026-05-13T20:38:14.641368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.03110","last_updated":"2026-04-03T15:35:07Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T22:52:20.577677Z","submitted_at":"2026-04-03T15:35:07Z","title":"Multi-Aspect Knowledge Distillation for Language Model with Low-rank Factorization"},"reference_resolution":{"displayed":4,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":4},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 4 of 4 outbound references and 0 inbound Pith citation observations for arXiv:2604.03110."}