{"as_of":"2026-08-09T13:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:45dbe5803934fc20e0e408b85fa02b8d6fbe5ca3d39f20b769cbd6c4d1ac7aee","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T11:34:57.198738Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:45:03.331296Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T22:45:05.037045Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"cited_work":{"arxiv_id":"2502.02671","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.02671","snapshot_observed_at":"2026-08-06T22:45:05.037045Z","title":"On Teacher Hacking in Language Model Distillation","venue":"cs.LG","work_id":"3344ea39-4300-4d9b-b255-277c8360ac47","year":2025},"citing_paper":{"arxiv_id":"2507.00054","last_updated":"2025-06-25T20:07:47Z","snapshot_observed_at":"2026-08-07T16:14:51.532240Z","submitted_at":"2025-06-25T20:07:47Z","title":"Enhancing Reasoning Capabilities in SLMs with Reward Guided Dataset Distillation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T22:45:03.331296Z"},"links":{"cited_paper":"/paper/2502.02671","citing_paper":"/paper/2507.00054"},"observation_digest":"sha256:a54f12fed5a09994fd9932645d2859e163326f1d91b12223f15291960c0c33b2","observation_id":"8a34b152-2464-440c-a5d0-9a7c4e36895b","resolution":{"observed_at":"2026-08-06T22:45:05.113351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02671/citation-record","integrity":"/paper/2502.02671/integrity","json":"/paper/2502.02671/citation-record.json","paper":"/paper/2502.02671"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.600349Z","title":null,"venue":null,"work_id":"5955842b-f4de-4468-86ae-13962d9500cb","year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.198738Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:1779e78432a54089776bfa5891318b08fba41c3b53c6331477647cae09caede1","observation_id":"2b76f6bd-3f57-457b-b833-4f55e15c42d3","resolution":{"observed_at":"2026-08-09T11:34:57.606640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13916","last_updated":"2022-06-16T21:12:42Z","snapshot_observed_at":"2026-07-06T11:52:19.105210Z","submitted_at":"2021-09-28T17:59:36Z","title":"Unsolved Problems in ML Safety","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13916","snapshot_observed_at":"2026-08-09T11:34:56.920640Z","title":"Hendrycks, D., Carlini, N., Schulman, J., and Steinhardt, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.920640Z"},"links":{"cited_paper":"/paper/2109.13916","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:473915fbee8b9fcb69c49f50fcfb157ac4e4bcca7f97cd53a653c7c3b141353f","observation_id":"960a8d90-3a91-4eda-aa8c-1c3ba9f7958d","resolution":{"observed_at":"2026-08-09T11:34:56.920640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.07947","last_updated":"2016-09-22T01:17:12Z","snapshot_observed_at":"2026-07-06T05:01:17.743844Z","submitted_at":"2016-06-25T18:16:39Z","title":"Sequence-Level Knowledge Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.07947","snapshot_observed_at":"2026-08-09T11:34:56.942721Z","title":"and Rush, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.942721Z"},"links":{"cited_paper":"/paper/1606.07947","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:36f887e10cac450396643fdf83c017fe2a0dedc1fb3a686cae9159023d0c76c5","observation_id":"9318d52b-f9ce-4aaf-9865-f47d734a62cd","resolution":{"observed_at":"2026-08-09T11:34:56.942721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.07253","last_updated":"2020-10-29T00:40:45Z","snapshot_observed_at":"2026-08-03T18:52:39.630483Z","submitted_at":"2020-09-15T17:43:02Z","title":"Autoregressive Knowledge Distillation through Imitation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.07253","snapshot_observed_at":"2026-08-09T11:34:56.975671Z","title":"Lin, A., Wohlwend, J., Chen, H., and Lei, T","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.975671Z"},"links":{"cited_paper":"/paper/2009.07253","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:2b87d1cfe5259c0f8f194f94d204818fff31147d2b9357275330300ab2ea2d6b","observation_id":"3d4cb55c-6109-4502-8d33-b59771de9ca1","resolution":{"observed_at":"2026-08-09T11:34:56.975671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-09T11:34:57.012110Z","title":"Deepseek- v3 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.012110Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:9cb7f75e693d43b79f9a3959f0b9cf11af49b644ac4f69be3e84e0af647e3fe3","observation_id":"380e2e34-d2b9-4b37-8a5c-2a7648de7c00","resolution":{"observed_at":"2026-08-09T11:34:57.012110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.636257Z","title":"B., and Lapata, M","venue":null,"work_id":"4a1d6b73-6daf-441b-8bb3-8701a1d60175","year":2018},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.042852Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:6cdafde0734dae6d840903805071146595fe03a762bd07b7e999261d5bc69e0f","observation_id":"2ae105ab-7403-4dea-80d8-168ec22821ea","resolution":{"observed_at":"2026-08-09T11:34:57.640894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03544","last_updated":"2022-02-14T09:05:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-10T18:58:52Z","title":"The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03544","snapshot_observed_at":"2026-08-09T11:34:57.100873Z","title":"The effects of reward misspecification: Mapping and mitigating misaligned models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.100873Z"},"links":{"cited_paper":"/paper/2201.03544","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:fc2440049cb4c9ff2a938aefcfcdc7ddbe0132e98411d2d980c271a2d633c060","observation_id":"a9d1e721-e2b8-4dc9-95e0-c08bbe5ec341","resolution":{"observed_at":"2026-08-09T11:34:57.100873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02900","last_updated":"2024-11-05T01:44:14Z","snapshot_observed_at":"2026-07-06T18:25:35.827334Z","submitted_at":"2024-06-05T03:41:37Z","title":"Scaling Laws for Reward Model Overoptimization in Direct Alignment Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02900","snapshot_observed_at":"2026-08-09T11:34:57.128745Z","title":"Scaling laws for reward model overoptimization in direct alignment algo- rithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.128745Z"},"links":{"cited_paper":"/paper/2406.02900","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:dcaf04da1f0ae2413ea6681ba43187d488b85b37bc35644fd413769439cef16d","observation_id":"b8af2d07-08a3-4725-832d-7f275034c4bd","resolution":{"observed_at":"2026-08-09T11:34:57.128745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12187","last_updated":"2024-01-22T18:27:08Z","snapshot_observed_at":"2026-07-30T18:16:51.527587Z","submitted_at":"2024-01-22T18:27:08Z","title":"WARM: On the Benefits of Weight Averaged Reward Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12187","snapshot_observed_at":"2026-08-09T11:34:57.150732Z","title":"Warm: On the bene- fits of weight averaged reward models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.150732Z"},"links":{"cited_paper":"/paper/2401.12187","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:69435a6b94fe392dd17b686b890415add9f013bbf02eb9f417442c21c611f865","observation_id":"a9917ce7-d6d8-45b9-a5cf-cfb28070d176","resolution":{"observed_at":"2026-08-09T11:34:57.150732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T11:34:57.156496Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram ´e, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.156496Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:4dfdd711a83f5cddc43ccfc4727d41b907aa095d70f0d80d3bddfd3e9c0609a7","observation_id":"742b1719-657f-4cad-91f1-eb939d2eaeec","resolution":{"observed_at":"2026-08-09T11:34:57.156496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17189","last_updated":"2022-03-31T17:12:13Z","snapshot_observed_at":"2026-07-06T12:55:23.720351Z","submitted_at":"2022-03-31T17:12:13Z","title":"Scaling Up Models and Data with $\\texttt{t5x}$ and $\\texttt{seqio}$","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17189","snapshot_observed_at":"2026-08-09T11:34:57.167515Z","title":"Sanh, V ., Debut, L., Chaumond, J., and Wolf, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.167515Z"},"links":{"cited_paper":"/paper/2203.17189","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:4fc195b01af1060c179703690d191100537d35d6ea77877dcac9e43ffe9a7522","observation_id":"2ff5f2db-b2b4-4252-a7d6-66a689e57f8c","resolution":{"observed_at":"2026-08-09T11:34:57.167515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-09T11:34:57.172471Z","title":"Stiennon, N., Ouyang, L., Wu, J., Ziegler, D., Lowe, R., V oss, C., Radford, A., Amodei, D., and Christiano, P","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.172471Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:f9cddfa68b2d2dae81c8a3808d22cbe619ea30cba4dba19edefffdf68c968fa1","observation_id":"4841ee5f-8954-4e5f-94d9-926bbc1fbbe3","resolution":{"observed_at":"2026-08-09T11:34:57.172471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05010","last_updated":"2023-05-08T19:31:09Z","snapshot_observed_at":"2026-07-06T15:24:45.921232Z","submitted_at":"2023-05-08T19:31:09Z","title":"Do Not Blindly Imitate the Teacher: Using Perturbed Loss for Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05010","snapshot_observed_at":"2026-08-09T11:34:57.189016Z","title":"Zhang, R., Shen, J., Liu, T., Liu, J., Bendersky, M., Najork, M., and Zhang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.189016Z"},"links":{"cited_paper":"/paper/2305.05010","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:fad6d629833c9db7952fb02b106ef429015d332bd3b87bcf07b4b0bf661e0b61","observation_id":"65b7cce2-5efb-4116-b854-1d57b5fe6d9a","resolution":{"observed_at":"2026-08-09T11:34:57.189016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.619321Z","title":null,"venue":null,"work_id":"3c9b457f-80f9-4ded-92c9-1d9c48f6c276","year":2022},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.194274Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:bfd787239c00c01e635ded726d8dd8004c15cec6842a6860fe38fe0ca38c5f94","observation_id":"175fecbf-e0a5-48ed-8931-99fe2d20241d","resolution":{"observed_at":"2026-08-09T11:34:57.624594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16944","last_updated":"2023-10-25T19:25:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-25T19:25:16Z","title":"Zephyr: Direct Distillation of LM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16944","snapshot_observed_at":"2026-08-09T11:34:57.178509Z","title":"Zephyr: Direct distillation of lm alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.178509Z"},"links":{"cited_paper":"/paper/2310.16944","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:5eca385669b7b872fc8ad4881f1e755c139d0200c226c9d09944b0f20653ad41","observation_id":"644c30ee-7652-440f-8220-041e2483eada","resolution":{"observed_at":"2026-08-09T11:34:57.178509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07319","last_updated":"2024-02-11T22:40:12Z","snapshot_observed_at":"2026-08-07T04:02:57.297390Z","submitted_at":"2024-02-11T22:40:12Z","title":"ODIN: Disentangled Reward Mitigates Hacking in RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07319","snapshot_observed_at":"2026-08-09T11:34:56.907788Z","title":"Odin: Disentangled reward mitigates hacking in rlhf","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.907788Z"},"links":{"cited_paper":"/paper/2402.07319","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:4f9b92438c19939f0f768c232a1bc4ac3e4d4a1d4db925c97d67b4007fd6a22f","observation_id":"a2d964af-fd96-4424-8667-bbc72aba3a2b","resolution":{"observed_at":"2026-08-09T11:34:56.907788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:56.901841Z","title":"doi: 10.3115/v1/W14-3302","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.901841Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:1503ef5e22cbd1363e7be7afcaf726c0feaf0e39e9c47a57fa7c6dfad01c0733","observation_id":"04bdcc2c-96f8-48f9-adb2-c35da20ea704","resolution":{"observed_at":"2026-08-09T11:34:56.901841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-07T22:21:53.513424Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-09T11:34:56.926817Z","title":"Tinybert: Distilling bert for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.926817Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:fe9e615d2cc111eded6dfaef2d4698942222b49fe5d15fa6884d03a9363b0e9c","observation_id":"b2f779b1-5788-41e3-a593-46cebc98585b","resolution":{"observed_at":"2026-08-09T11:34:56.926817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-09T11:34:56.890311Z","title":"Training a helpful and harmless assistant with rein- forcement learning from human feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.890311Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:efd6e39636b62b5f178db00714c69568ddc3537121d01061ce0e627fd91c3b54","observation_id":"d2140783-1c12-4353-84c9-6e64a19afbdb","resolution":{"observed_at":"2026-08-09T11:34:56.890311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.071170Z","title":"doi: 10.18653/v1/D18-1206","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.071170Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:628e4f4a12d5010c57c9b86f658268cc8e4e460c0187fe822b970e738a01feda","observation_id":"a4c2bbc3-3adc-4e7f-b305-b9f914a969ac","resolution":{"observed_at":"2026-08-09T11:34:57.071170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-09T11:34:56.932470Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.932470Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:a61dcb0cbc576ad949d677f77b9599514a369bd9d7323a8695f11afbb48239ac","observation_id":"e3446707-e7f7-4986-9c56-b33813e27238","resolution":{"observed_at":"2026-08-09T11:34:56.932470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12842","last_updated":"2024-09-27T06:25:33Z","snapshot_observed_at":"2026-07-06T17:32:44.565172Z","submitted_at":"2024-02-20T09:10:08Z","title":"PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12842","snapshot_observed_at":"2026-08-09T11:34:56.937688Z","title":"Promptkd: Distilling student-friendly knowledge for generative language mod- els via prompt tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.937688Z"},"links":{"cited_paper":"/paper/2402.12842","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:d3d9c6bf8593db1087ab5becb881f38ef779e1089d6b16df6b2ae949188a08f6","observation_id":"5079aeb4-3010-4a7a-b30e-1bacc08cb956","resolution":{"observed_at":"2026-08-09T11:34:56.937688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12822","last_updated":"2024-12-08T04:06:53Z","snapshot_observed_at":"2026-07-06T19:18:12.969683Z","submitted_at":"2024-09-19T14:50:34Z","title":"Language Models Learn to Mislead Humans via RLHF","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12822","snapshot_observed_at":"2026-08-09T11:34:57.183913Z","title":"R., He, H., and Feng, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:57.183913Z"},"links":{"cited_paper":"/paper/2409.12822","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:eda81405563e2e7914c9201d2122d33a51c84737f34b86fa72ae14a2084bf95d","observation_id":"bf2cbe1c-3a37-4d91-9527-518e6f543717","resolution":{"observed_at":"2026-08-09T11:34:57.183913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T11:34:57.652540Z","title":"Findings of the 2014 workshop on statistical machine translation","venue":null,"work_id":"2524c33a-113b-4051-9975-3ae71644133f","year":2014},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.896299Z"},"links":{"citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:0434f196f4adcedc8dbdb3cda614037956c03e42f0207145a6149bb5e61ac01b","observation_id":"e5037d20-7ab6-4d33-8ca2-542aea9cc5b3","resolution":{"observed_at":"2026-08-09T11:34:57.658851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-09T11:34:56.914050Z","title":"I., Burnell, R., Bai, L., Gulati, A., Tanzer, G., Vincent, D., Pan, Z., Wang, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.914050Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:deaf218a098617dd5b30a4cd7961e3b7d9b7b7dcaf72eaea85d208131472bdec","observation_id":"be93f680-b27a-4f21-985b-94a377288f4a","resolution":{"observed_at":"2026-08-09T11:34:56.914050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-09T11:34:56.883725Z","title":"net/forum?id=3zKtaqxLhW","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T11:34:56.883725Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2502.02671"},"observation_digest":"sha256:b1d35103f9bb41d5d43fc46457d7fe959bfbe64549217558323db3e1cb26ac1b","observation_id":"867258ab-a084-4776-b325-c25c5abea41e","resolution":{"observed_at":"2026-08-09T11:34:56.883725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.02671","last_updated":"2025-02-04T19:26:28Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T11:29:05.385896Z","submitted_at":"2025-02-04T19:26:28Z","title":"On Teacher Hacking in Language Model Distillation"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2502.02671."}