{"as_of":"2026-08-12T18:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ccbbb085afa555dacbdd932f8e85d91a6d799c5517e8c8746f9c336b0923e61b","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:47:09.505974Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.09807/citation-record","integrity":"/paper/2412.09807/integrity","json":"/paper/2412.09807/citation-record.json","paper":"/paper/2412.09807"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T16:47:09.278895Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.278895Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:b8ec0cc331338a0027d8fa878a252cb8d081eeca84bdd7dc615bcd3057ff6df0","observation_id":"e2b9d5fe-18bd-4d53-b5d8-5a89bd645d41","resolution":{"observed_at":"2026-08-11T16:47:09.278895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.283845Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.283845Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:a48f1ae81053de7efa6909171b7c7177a6718cde9b43b24b6184bfb4905d8110","observation_id":"bc0ae0e7-98a4-482a-b694-5c3485dc1c8e","resolution":{"observed_at":"2026-08-11T16:47:09.283845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-11T16:47:09.287792Z","title":"Gemini: A family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.287792Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:92d4368d2f25ce641e814f8a21519e125cabd04f4d4b438340f3fb414e9a9e3f","observation_id":"c759c4f3-9e2c-48e7-9b06-a43c36cb4f0c","resolution":{"observed_at":"2026-08-11T16:47:09.287792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-11T16:47:09.291810Z","title":"Palm 2 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.291810Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:d6bef2eda9ca73d7054ccf41d13f370b2a0ec956b680911e2c46c169cb715b46","observation_id":"183fa3a8-af90-4af6-a7ce-b1cf7270ae13","resolution":{"observed_at":"2026-08-11T16:47:09.291810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.249374Z","title":"Generating questions and multiple-choice answers using semantic analysis of texts","venue":null,"work_id":"17bd9d40-7efb-4dc3-9875-40defa7eb192","year":2016},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.296575Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:8208752fbe0a63b06fb01aa382f12fb9acf16bbb1ab9aea191a893653336e8a8","observation_id":"b53c09a4-4729-4fbd-98e3-50c562b9b8ac","resolution":{"observed_at":"2026-08-11T16:47:10.253673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T16:47:09.300987Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.300987Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:cc9dbf62b06f5d915712e8d0565649f3d8261fad5c32f6b3a676b5bc9e2c3ecd","observation_id":"5baaeb5b-cc9e-49a9-a084-c6387d0153b7","resolution":{"observed_at":"2026-08-11T16:47:09.300987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10534","last_updated":"2023-06-05T19:16:25Z","snapshot_observed_at":"2026-08-11T02:47:03.143686Z","submitted_at":"2022-12-20T18:46:08Z","title":"DISCO: Distilling Counterfactuals with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10534","snapshot_observed_at":"2026-08-11T16:47:09.307247Z","title":"Disco: Distilling counterfactuals with large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.307247Z"},"links":{"cited_paper":"/paper/2212.10534","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:229c401021d4c44667b2e5d286994d5b6488ce0c7452581257fe834f3740222c","observation_id":"a89b87ed-5bde-4dee-a300-5283a9a9df73","resolution":{"observed_at":"2026-08-11T16:47:09.307247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.236373Z","title":"Chatgpt versus human in generating medical graduate exam multiple choice questions—a multinational prospective study (hong kong sar, singapore, ireland, and the united kingdom)","venue":null,"work_id":"965803b1-dc40-4b85-9c50-f226c2ea3bca","year":2023},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.312770Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:04f1dc7ac73cbd61e7b297d52566e9d2023be543eb03d18163583f05db19eee3","observation_id":"23917871-ffd9-40d6-9b76-0745c1e73a6c","resolution":{"observed_at":"2026-08-11T16:47:10.241257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.316408Z","title":"Scaling instruction-finetuned language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.316408Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:db2b368da1133a14ffc30d4cc16fbf011e5dc4445b194f24b2d27cf1d5605a7a","observation_id":"255c29e6-af0b-4f77-a1a0-49bee9a3c222","resolution":{"observed_at":"2026-08-11T16:47:09.316408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04140","last_updated":"2023-06-07T04:27:09Z","snapshot_observed_at":"2026-08-10T18:54:25.054653Z","submitted_at":"2023-06-07T04:27:09Z","title":"Increasing Diversity While Maintaining Accuracy: Text Data Generation with Large Language Models and Human Interventions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04140","snapshot_observed_at":"2026-08-11T16:47:09.320208Z","title":"Increasing diversity while maintaining accuracy: Text data generation with large language models and human interventions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.320208Z"},"links":{"cited_paper":"/paper/2306.04140","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:47d3b8d96f442988282aea90c97c016abb351cd0844210bdd1dec732e6384c0a","observation_id":"20a83bd2-02d8-425a-9032-e9b6841dfe90","resolution":{"observed_at":"2026-08-11T16:47:09.320208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-11T16:47:09.324073Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.324073Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:5ef69334b3b2d9216ae612ce4b845d031de5cc0e5d15a3d4d8ad58a5af9c9b2a","observation_id":"069a4207-1985-4e61-9b14-d205e6af74db","resolution":{"observed_at":"2026-08-11T16:47:09.324073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T16:47:09.327945Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.327945Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:e50804dc711d00da6c739b35628a51c2f5813e817a404a672ff534b6ee7b2d45","observation_id":"042d43ca-2c19-4a7b-85ab-0b017ba458d2","resolution":{"observed_at":"2026-08-11T16:47:09.327945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T16:47:09.331816Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.331816Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:1b1c71a21248513c4977ca559d85092d8c375a51cf0b6cb274faf9ea7425fe47","observation_id":"3fedc652-29bb-4caa-9b13-f8b74056ba74","resolution":{"observed_at":"2026-08-11T16:47:09.331816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.03075","last_updated":"2021-12-01T21:05:30Z","snapshot_observed_at":"2026-08-09T21:37:48.619753Z","submitted_at":"2021-05-07T06:03:45Z","title":"A Survey of Data Augmentation Approaches for NLP","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.03075","snapshot_observed_at":"2026-08-11T16:47:09.335484Z","title":"A survey of data augmentation approaches for nlp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.335484Z"},"links":{"cited_paper":"/paper/2105.03075","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:84629a604020b6958f9ab087f789f6d1d8db827ec0810fb2a7ed957aa1e930ce","observation_id":"711c5711-608c-41fa-9025-5d428fdf9338","resolution":{"observed_at":"2026-08-11T16:47:09.335484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.339588Z","title":"Minillm: Knowledge distillation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.339588Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:2b3de99ad35c1f87d094edea8197ac9e549d5dfeb30cb08ce3e597515decae5d","observation_id":"35ad2235-d23c-422c-8e3e-4b5a591613d3","resolution":{"observed_at":"2026-08-11T16:47:09.339588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-11T16:47:09.343324Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.343324Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:c4eea779e1b9275fd3a5e52d2e740a6f9420e1e4ffefbb67d53fb9dba46177d6","observation_id":"bd1afc28-d43e-4b20-b4bd-6b775f708f95","resolution":{"observed_at":"2026-08-11T16:47:09.343324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-11T16:47:09.347658Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.347658Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:59bffcb58e0401ddcc715e0c3341db25b01ea10964eb13d07a7b8e5231f8f40c","observation_id":"0ac6dea2-49eb-4db4-bc4e-2c9d8043ff70","resolution":{"observed_at":"2026-08-11T16:47:09.347658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.351876Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.351876Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:1327cbb7ee77c1bdebeaf0498be2182a533404f4c05d8252b753fcb48dcc5d4f","observation_id":"cb115b0f-7834-4015-96f5-40bde63d1f48","resolution":{"observed_at":"2026-08-11T16:47:09.351876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.07947","last_updated":"2016-09-22T01:17:12Z","snapshot_observed_at":"2026-08-12T12:33:37.687350Z","submitted_at":"2016-06-25T18:16:39Z","title":"Sequence-Level Knowledge Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.07947","snapshot_observed_at":"2026-08-11T16:47:09.357303Z","title":"Sequence-level knowledge distillation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.357303Z"},"links":{"cited_paper":"/paper/1606.07947","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:2bbf607b6b9d5ff068216f72503aa0e263fe36c0a75e75bb8fb376fcb7ac7234","observation_id":"a7954287-0765-4e27-b3ac-ae7df1a5ccf6","resolution":{"observed_at":"2026-08-11T16:47:09.357303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T16:47:09.361418Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.361418Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:4e78a68835c14cec5982f1e31ac99e24c8efb806d2abb625a8dce1e94d8dbc4c","observation_id":"20e37bd9-5a10-4b16-9ea8-c44e1db6b1fa","resolution":{"observed_at":"2026-08-11T16:47:09.361418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.196202Z","title":"Chatgpt prompts for generating multiple-choice questions in medical education and evidence on their validity: a literature review","venue":null,"work_id":"df848516-4eb1-413b-8422-8e3b2203759a","year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.365755Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:4666f680310e0dc9364434d895996b0f7790daf2d93df0ef1915d1fb1f243b81","observation_id":"96d04787-cba4-41bf-a6d2-456c22d2baa2","resolution":{"observed_at":"2026-08-11T16:47:10.200796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.02846","last_updated":"2021-09-07T03:59:22Z","snapshot_observed_at":"2026-08-11T03:53:07.832446Z","submitted_at":"2021-09-07T03:59:22Z","title":"Datasets: A Community Library for Natural Language Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.02846","snapshot_observed_at":"2026-08-11T16:47:09.370025Z","title":"Datasets: A community library for natural language processing","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.370025Z"},"links":{"cited_paper":"/paper/2109.02846","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:5b36791529c16239a11f01567ec1aef6b7d820ccaf970b47ac7ee10890164951","observation_id":"c97c5f75-4c9c-4e0f-9390-2358802b8892","resolution":{"observed_at":"2026-08-11T16:47:09.370025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06259","last_updated":"2024-03-12T05:22:46Z","snapshot_observed_at":"2026-07-06T16:05:23.421896Z","submitted_at":"2023-08-11T17:47:54Z","title":"Self-Alignment with Instruction Backtranslation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06259","snapshot_observed_at":"2026-08-11T16:47:09.374343Z","title":"Self-alignment with instruction backtranslation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.374343Z"},"links":{"cited_paper":"/paper/2308.06259","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:dc85aa010e8e31f4cb259fca0f433749e9b3606b76f274634f6175526cb722b5","observation_id":"675e0e51-0d13-461a-97a4-6ce7c5a4552a","resolution":{"observed_at":"2026-08-11T16:47:09.374343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.184424Z","title":"Distractor generation for multiple choice questions using learning to rank","venue":null,"work_id":"5069efa6-4026-4a9e-946c-e82472c83992","year":2018},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.378375Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:b0d22787c968b9d077f66747a572475f3b0f7c23a98c44ada227fb961bfb9572","observation_id":"48a173d6-d763-4571-af30-f38ff7e027a1","resolution":{"observed_at":"2026-08-11T16:47:10.188002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17262","last_updated":"2024-06-25T04:03:04Z","snapshot_observed_at":"2026-08-05T00:49:56.451282Z","submitted_at":"2024-06-25T04:03:04Z","title":"D2LLM: Decomposed and Distilled Large Language Models for Semantic Search","version":1},"cited_work":{"arxiv_id":"2406.17262","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.17262","snapshot_observed_at":"2026-08-11T16:47:09.711837Z","title":"D2LLM: Decomposed and Distilled Large Language Models for Semantic Search","venue":"cs.CL","work_id":"d3884b6f-b317-4772-a021-b5bac2f520a3","year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.382579Z"},"links":{"cited_paper":"/paper/2406.17262","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:95122dae0b5ab265c35f183b5a5946c4d0328c90093d2d38f3681393c0dee314","observation_id":"5b8221de-dc73-433b-a634-6f275e515bae","resolution":{"observed_at":"2026-08-11T16:47:09.719488Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-11T16:47:09.386066Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.386066Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:44fc2767bc5f10f83b4320a8db34a8aaa2525acd0d8624d8de9e5f608d81f60d","observation_id":"93296338-a532-4b2e-9ae1-39475a5dc96c","resolution":{"observed_at":"2026-08-11T16:47:09.386066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15126","last_updated":"2024-06-14T07:47:09Z","snapshot_observed_at":"2026-08-10T18:53:57.762381Z","submitted_at":"2024-06-14T07:47:09Z","title":"On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15126","snapshot_observed_at":"2026-08-11T16:47:09.391170Z","title":"On llms-driven synthetic data generation, curation, and evaluation: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.391170Z"},"links":{"cited_paper":"/paper/2406.15126","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:9d3c0b038f4059f7eefd95e80755b86912e2177cf9d194bec4c33f972a48cc5c","observation_id":"53480295-9a46-4f9a-97f6-ab4dc07af994","resolution":{"observed_at":"2026-08-11T16:47:09.391170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.173211Z","title":"Does label smoothing mitigate label noise? In International Conference on Machine Learning, pp.\\ 6448--6458","venue":null,"work_id":"35050b37-a120-4bb2-9181-b2c4ddce87bc","year":2020},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.396913Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:ba34bf28d68524e7daa8cad61c60e51fb901426a38932d24ae5268f7490d9aea","observation_id":"58328574-2585-48a3-872a-5abfa79f0f98","resolution":{"observed_at":"2026-08-11T16:47:10.177032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.401487Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.401487Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:68b1b07b8cbfe572c5eba7ef762cbdfc0fe117e2e330a9ac8c40616ef336972b","observation_id":"c2229463-0f48-49b1-ad5c-8b512f1d4bc0","resolution":{"observed_at":"2026-08-11T16:47:09.401487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.152281Z","title":"Leveraging large language models for multiple choice question answering","venue":null,"work_id":"60fbb6ca-e94d-4b92-83fa-289a3ac54441","year":2023},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.405910Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:6a18d5562e94fb33f37528071e17b4040945680f3bded546f93744ae03e79273","observation_id":"e79b4742-aa78-4e2b-a17e-3f92e5dd4b48","resolution":{"observed_at":"2026-08-11T16:47:10.156091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.139770Z","title":"End-to-end generation of multiple-choice questions using text-to-text transfer transformer models","venue":null,"work_id":"764e0901-cf24-4abe-9071-f95a73c13484","year":2022},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.410808Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:44d5f5a324cff0455ff9e6068c194369cd951e1542ef1c133efed26f5a141165","observation_id":"fb97d68e-fed6-4dad-8cf0-9f552f9c574f","resolution":{"observed_at":"2026-08-11T16:47:10.144074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.126144Z","title":"tasksource: A large collection of NLP tasks with a structured dataset preprocessing framework","venue":null,"work_id":"c5a5c92c-d903-4467-84f8-bf0cdb0705e4","year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.414787Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:eadfd6af22bc4c10d210fb9b0c7dde66d984f597d72ca75c9f28bef3e44f3bfd","observation_id":"8bcb5c5d-818b-4693-8438-80fe65d81bfa","resolution":{"observed_at":"2026-08-11T16:47:10.130955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.113233Z","title":"Automatic generation of multiple choice questions using wikipedia","venue":null,"work_id":"4e8869b9-b5ad-440c-a665-aca0da8450ed","year":2013},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.420059Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:f4e66db6c9d641fe7cc329e12930fa53c2818b3e9f163d993725f537d28b5dcf","observation_id":"ff41671d-2410-4563-9daa-f87faad81a1c","resolution":{"observed_at":"2026-08-11T16:47:10.117993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.425586Z","title":"Rethinking the inception architecture for computer vision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.425586Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:9f5b5d2a580d40b1a2401fb64ec830cadd96d350fcd1ebb0939ebb52fee60a72","observation_id":"c31949c6-b093-41fe-a35e-4372191d91be","resolution":{"observed_at":"2026-08-11T16:47:09.425586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-11T16:47:09.430426Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.430426Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:a53377ad0e304e869a67f58b210bbaa6a7024e350a58b12b7daedcddd8e85055","observation_id":"430c5bec-e74c-4a41-bd41-834f31761677","resolution":{"observed_at":"2026-08-11T16:47:09.430426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T16:47:09.434340Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.434340Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:42ce63ed85124b512c6b586ff8e0f11e386c07eab3f4cc65deba4f62ab950756","observation_id":"6032928c-ba49-4caa-9c1e-77bbe023ce1c","resolution":{"observed_at":"2026-08-11T16:47:09.434340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.439085Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.439085Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:a9dc64ab349f085c2400fbdf5115d8d469d083b8c54d7cebf1ad4cb42cb16fa9","observation_id":"bd08b2bd-e5bf-4fb5-8945-5ec64550e085","resolution":{"observed_at":"2026-08-11T16:47:09.439085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-06T06:05:27.671303Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-08-11T16:47:09.443481Z","title":"Crowdsourcing multiple choice science questions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.443481Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:0ccc6d255489b1f1ec5972dc99b901a3af8f97f22d5b894f8fd95f464511e051","observation_id":"4de23236-ef01-4069-b262-9fad47e5d917","resolution":{"observed_at":"2026-08-11T16:47:09.443481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.082260Z","title":"Transformers: State-of-the-art natural language processing","venue":null,"work_id":"63dc35b2-73e6-4595-ae82-2cffea1b07ea","year":2020},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.449263Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:40c3014dbe451a46a0bbb7a4ebc5c530d9c6d2b7c30f678b429f840057b1b3a5","observation_id":"137179cf-49ea-4542-a9e8-a162873a7bbc","resolution":{"observed_at":"2026-08-11T16:47:10.087291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-10T17:26:33.432994Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-11T16:47:09.458652Z","title":"A survey on knowledge distillation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.458652Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:7846f89d3c4f7df80dedef62cc516ed60a22f222a1a3ce6328b7113bc9479d68","observation_id":"e2e272d1-1eef-4c0d-9590-cb4f15b81101","resolution":{"observed_at":"2026-08-11T16:47:09.458652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14367","last_updated":"2024-01-25T18:14:57Z","snapshot_observed_at":"2026-07-06T17:20:33.356092Z","submitted_at":"2024-01-25T18:14:57Z","title":"Genie: Achieving Human Parity in Content-Grounded Datasets Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14367","snapshot_observed_at":"2026-08-11T16:47:09.464733Z","title":"Genie: Achieving human parity in content-grounded datasets generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.464733Z"},"links":{"cited_paper":"/paper/2401.14367","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:5ee9c6eab008e036130c4b9faecd8ab2ebdc8cfc8956be87ea76a1573f5809d0","observation_id":"03cbcc9c-9b6e-423c-811e-0614db246965","resolution":{"observed_at":"2026-08-11T16:47:09.464733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13578","last_updated":"2024-06-19T14:12:05Z","snapshot_observed_at":"2026-08-03T13:56:46.247252Z","submitted_at":"2024-06-19T14:12:05Z","title":"Enhancing Distractor Generation for Multiple-Choice Questions with Retrieval Augmented Pretraining and Knowledge Graph Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13578","snapshot_observed_at":"2026-08-11T16:47:09.469941Z","title":"Enhancing distractor generation for multiple-choice questions with retrieval augmented pretraining and knowledge graph integration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.469941Z"},"links":{"cited_paper":"/paper/2406.13578","citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:33f525ab6896a6575b28fffa4b0897e4c2805279529ef6b80de4cf4a101eeb51","observation_id":"fad49b37-1cc7-49d7-803f-c76531e4457c","resolution":{"observed_at":"2026-08-11T16:47:09.469941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:10.067545Z","title":"When does pretraining help? assessing self-supervised learning for law and the casehold dataset of 53,000+ legal holdings","venue":null,"work_id":"e000a6c7-491c-408e-9ad9-7eb2f52ceabf","year":2021},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.478716Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:592a4ffb9fc59e36e13807ae41cf6e914bb94c253de3e524e29afd7d7eca163d","observation_id":"41643ad8-0295-4acb-9896-41cc63b3401c","resolution":{"observed_at":"2026-08-11T16:47:10.073506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.483402Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.483402Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:c5792902bc86a7fb47abceb92b488f79851edff08a073bd10522f6c100f99b3e","observation_id":"0ae691e2-e300-4723-b1f1-7767684adc48","resolution":{"observed_at":"2026-08-11T16:47:09.483402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.490008Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.490008Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:182fd9eb64210b022c720d5b64774acacf63a44f4aeda9912e9aab88b8abe268","observation_id":"81b0edfd-c307-4650-9f2b-c03d188cb10d","resolution":{"observed_at":"2026-08-11T16:47:09.490008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.496931Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.496931Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:24342a2be12c100a864fde2881580209a4f6ca95f7d6b783ccb0fa82625a0e82","observation_id":"1fb76584-20c2-4e38-9c24-b933f1cc9e04","resolution":{"observed_at":"2026-08-11T16:47:09.496931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:47:09.505974Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T16:47:09.505974Z"},"links":{"citing_paper":"/paper/2412.09807"},"observation_digest":"sha256:e6d6a097bda88a64faacadecc66361979d9307ed7571adc60742532c1c5f507a","observation_id":"bd6c359d-231c-4e6e-9377-6f465ece269a","resolution":{"observed_at":"2026-08-11T16:47:09.505974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.09807","last_updated":"2024-12-30T16:45:50Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T12:51:28.170206Z","submitted_at":"2024-12-13T02:48:36Z","title":"LLM Distillation for Efficient Few-Shot Multiple Choice Question Answering"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2412.09807."}