{"as_of":"2026-08-12T23:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa91853a64c10a3b8116b0e62153a5aba3ab22b157fed6c5df26689a171cd603","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:39:43.113333Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T12:05:43.645108Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1904.09482","last_updated":"2019-04-20T19:11:00Z","snapshot_observed_at":"2026-08-04T02:03:00.719600Z","submitted_at":"2019-04-20T19:11:00Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","version":1},"cited_work":{"arxiv_id":"1904.09482","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.09482","snapshot_observed_at":"2026-07-01T12:05:43.645108Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","venue":"cs.CL","work_id":"ca3cef6e-af7c-4e5c-aa36-5baf1aa2c7a0","year":2019},"citing_paper":{"arxiv_id":"1905.00537","last_updated":"2020-02-13T00:28:00Z","snapshot_observed_at":"2026-08-12T12:17:26.135577Z","submitted_at":"2019-05-02T00:41:50Z","title":"SuperGLUE: A Stickier Benchmark for General-Purpose Language Understanding Systems","version":3},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-05-15T01:34:10.604864Z"},"links":{"cited_paper":"/paper/1904.09482","citing_paper":"/paper/1905.00537"},"observation_digest":"sha256:e5388103fc1e8ca8cb12e73042d75810cf2fa4d1f0ef12805d66b98c0eaa14c4","observation_id":"66fc3834-df64-4a0d-8379-927c900e7ceb","resolution":{"observed_at":"2026-05-15T01:34:10.750216Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09482","last_updated":"2019-04-20T19:11:00Z","snapshot_observed_at":"2026-08-04T02:03:00.719600Z","submitted_at":"2019-04-20T19:11:00Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","version":1},"cited_work":{"arxiv_id":"1904.09482","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.09482","snapshot_observed_at":"2026-07-01T12:05:43.645108Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","venue":"cs.CL","work_id":"ca3cef6e-af7c-4e5c-aa36-5baf1aa2c7a0","year":2019},"citing_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-09T04:47:43.784327Z"},"links":{"cited_paper":"/paper/1904.09482","citing_paper":"/paper/1907.11692"},"observation_digest":"sha256:68dd008b61d0dd14c43b4992deeab2c325a97d7a97a8e88b03ac8b823aed6e84","observation_id":"09067d6e-ede4-4afc-a354-aa376cbfba05","resolution":{"observed_at":"2026-05-09T04:47:44.419233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09482","last_updated":"2019-04-20T19:11:00Z","snapshot_observed_at":"2026-08-04T02:03:00.719600Z","submitted_at":"2019-04-20T19:11:00Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","version":1},"cited_work":{"arxiv_id":"1904.09482","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.09482","snapshot_observed_at":"2026-07-01T12:05:43.645108Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","venue":"cs.CL","work_id":"ca3cef6e-af7c-4e5c-aa36-5baf1aa2c7a0","year":2019},"citing_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T12:05:38.045330Z"},"links":{"cited_paper":"/paper/1904.09482","citing_paper":"/paper/2005.14165"},"observation_digest":"sha256:ef2379f5c54a2a1868b7c9c48d7b7983012b5bed2fba1bdcb036685a548ae5e2","observation_id":"9ad833fc-1263-46d4-a4b4-351f49b19905","resolution":{"observed_at":"2026-05-10T12:05:38.287174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09482","last_updated":"2019-04-20T19:11:00Z","snapshot_observed_at":"2026-08-04T02:03:00.719600Z","submitted_at":"2019-04-20T19:11:00Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","version":1},"cited_work":{"arxiv_id":"1904.09482","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.09482","snapshot_observed_at":"2026-07-01T12:05:43.645108Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","venue":"cs.CL","work_id":"ca3cef6e-af7c-4e5c-aa36-5baf1aa2c7a0","year":2019},"citing_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-10T20:53:16.720145Z"},"links":{"cited_paper":"/paper/1904.09482","citing_paper":"/paper/2205.01068"},"observation_digest":"sha256:49b057d44e85b78b2d84bdb4d06f9526286a0d27f184498b7ab3fd24039c7495","observation_id":"e433a410-ddc6-42cc-ade1-d9b807864690","resolution":{"observed_at":"2026-05-10T20:53:17.356706Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09482","last_updated":"2019-04-20T19:11:00Z","snapshot_observed_at":"2026-08-04T02:03:00.719600Z","submitted_at":"2019-04-20T19:11:00Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","version":1},"cited_work":{"arxiv_id":"1904.09482","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.09482","snapshot_observed_at":"2026-07-01T12:05:43.645108Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","venue":"cs.CL","work_id":"ca3cef6e-af7c-4e5c-aa36-5baf1aa2c7a0","year":2019},"citing_paper":{"arxiv_id":"2606.30775","last_updated":"2026-06-29T18:06:43Z","snapshot_observed_at":"2026-07-07T00:04:34.491408Z","submitted_at":"2026-06-29T18:06:43Z","title":"A Single Rewrite Suffices: Empirical Lessons from Production Skill Description Optimization","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-07-01T02:32:19.425550Z"},"links":{"cited_paper":"/paper/1904.09482","citing_paper":"/paper/2606.30775"},"observation_digest":"sha256:79c0522ce9f4724e06d92b03da6368d6fc55f9df1b8714bbbe135a4c6ae3dff6","observation_id":"7710523c-049b-4ef7-af6f-651b572a44c7","resolution":{"observed_at":"2026-07-01T12:05:43.646468Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09482","last_updated":"2019-04-20T19:11:00Z","snapshot_observed_at":"2026-08-04T02:03:00.719600Z","submitted_at":"2019-04-20T19:11:00Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09482","snapshot_observed_at":"2026-08-10T17:39:43.113333Z","title":"arXiv preprint arXiv:1904.09482 , year=","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2608.06963","last_updated":"2026-08-07T08:40:40Z","snapshot_observed_at":"2026-08-12T23:11:35.922748Z","submitted_at":"2026-08-07T08:40:40Z","title":"Learning in Deep Networks under Dale's Constraint","version":1},"reference_index":191,"source":"arxiv_source","source_observed_at":"2026-08-10T17:39:43.113333Z"},"links":{"cited_paper":"/paper/1904.09482","citing_paper":"/paper/2608.06963"},"observation_digest":"sha256:601eddbf5c46c8471cab1495e68e8432f6e9e9919599e169cb85ce2d2363d23e","observation_id":"4d60813d-d9fc-4c44-8f66-eea47d6b1818","resolution":{"observed_at":"2026-08-10T17:39:43.113333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1904.09482/citation-record","integrity":"/paper/1904.09482/integrity","json":"/paper/1904.09482/citation-record.json","paper":"/paper/1904.09482"},"outbound":[],"paper":{"arxiv_id":"1904.09482","last_updated":"2019-04-20T19:11:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T02:03:00.719600Z","submitted_at":"2019-04-20T19:11:00Z","title":"Improving Multi-Task Deep Neural Networks via Knowledge Distillation for Natural Language Understanding"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:1904.09482."}