{"as_of":"2026-08-15T16:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:62f8ee2bd582da2d9b8414c884f23700eae55ae70bfcbf56bc4c668f4c209a25","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:33:46.058665Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08726/citation-record","integrity":"/paper/2608.08726/integrity","json":"/paper/2608.08726/citation-record.json","paper":"/paper/2608.08726"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-13T14:47:47.249767Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-08-14T04:33:45.980012Z","title":"arXiv preprint arXiv:2601.18734 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:45.980012Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:fcb6ba234623a1f2eaf7515771e05fb53638e1a509e3256bc848220a230983b9","observation_id":"c048227a-df3b-4f60-bb45-c7a894c726ec","resolution":{"observed_at":"2026-08-14T04:33:45.980012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12002","last_updated":"2026-06-11T04:21:23Z","snapshot_observed_at":"2026-08-11T06:47:39.541564Z","submitted_at":"2026-04-13T19:46:55Z","title":"Self-Distillation Zero: Self-Revision Turns Binary Rewards into Dense Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12002","snapshot_observed_at":"2026-08-14T04:33:45.984767Z","title":"arXiv preprint arXiv:2604.12002 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:45.984767Z"},"links":{"cited_paper":"/paper/2604.12002","citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:178e0155b889894ddf0d9e609e02c6f7204d63b26d881a7ac742e959f574a0ea","observation_id":"b9d8a3d1-4bff-4a36-bd94-e8f7225f32b9","resolution":{"observed_at":"2026-08-14T04:33:45.984767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.18955","last_updated":"2026-07-21T10:47:27Z","snapshot_observed_at":"2026-08-13T16:29:04.186725Z","submitted_at":"2026-07-21T10:47:27Z","title":"H$^2$SD: Hybrid Hindsight Self-Distillation","version":1},"cited_work":{"arxiv_id":"2607.18955","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.18955","snapshot_observed_at":"2026-08-14T04:33:46.205247Z","title":"H$^2$SD: Hybrid Hindsight Self-Distillation","venue":"cs.LG","work_id":"a2107d74-c48a-4feb-99e2-6ae6dec34781","year":2026},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:45.990906Z"},"links":{"cited_paper":"/paper/2607.18955","citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:27ae76600d8946b1b4e99673667229719cf5b22037f464d735d3f8c9bef380a8","observation_id":"586b91f6-c16b-41a6-aa22-b54c2ac94b22","resolution":{"observed_at":"2026-08-14T04:33:46.211750Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:46.327658Z","title":"Knowledge-Based Systems , volume=","venue":null,"work_id":"dbd942dc-06ad-4f88-b5bc-50d801447cc9","year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:45.995195Z"},"links":{"citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:cbdd94b4676043072d5adeb4b007c99f6eaf089bc76f42c02742eeba335f4664","observation_id":"ed78f480-288f-4726-827b-11cdb21adda4","resolution":{"observed_at":"2026-08-14T04:33:46.339275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2608.00782","last_updated":"2026-08-01T17:29:14Z","snapshot_observed_at":"2026-08-07T03:55:00.582409Z","submitted_at":"2026-08-01T17:29:14Z","title":"Distill Where You Fail: Recovering Learning Signals of Negative RL-Groups from Adaptive Teacher Guidance","version":1},"cited_work":{"arxiv_id":"2608.00782","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.00782","snapshot_observed_at":"2026-08-14T04:33:46.186004Z","title":"Distill Where You Fail: Recovering Learning Signals of Negative RL-Groups from Adaptive Teacher Guidance","venue":"cs.CL","work_id":"fa921dd0-061f-4fb7-9221-8ab1cdc7765b","year":2026},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:45.999549Z"},"links":{"cited_paper":"/paper/2608.00782","citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:57c944bc534e3a67b221076552e1c4d2c6efd866819d934cc5d1754bb716bdec","observation_id":"ec05f5f3-4031-49be-9fb1-1764c66a212f","resolution":{"observed_at":"2026-08-14T04:33:46.190443Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2608.01589","last_updated":"2026-08-03T01:47:25Z","snapshot_observed_at":"2026-08-13T09:10:47.593849Z","submitted_at":"2026-08-03T01:47:25Z","title":"Is More Privileged Information Better? From Solution Traces to Problem-Solving Structure in Self-Distilled Reasoning","version":1},"cited_work":{"arxiv_id":"2608.01589","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.01589","snapshot_observed_at":"2026-08-14T04:33:46.161096Z","title":"Is More Privileged Information Better? From Solution Traces to Problem-Solving Structure in Self-Distilled Reasoning","venue":"cs.AI","work_id":"90f4d424-e158-4c54-b3e6-38543d5fd9fd","year":2026},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.003541Z"},"links":{"cited_paper":"/paper/2608.01589","citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:59f1f5d5858fa8f3e057862910a16f2f6ab44e221e8a1bb9bc60eeef8dd2f397","observation_id":"52040c87-d5fd-46f5-8c95-f6ffbfc70915","resolution":{"observed_at":"2026-08-14T04:33:46.167317Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26573","last_updated":"2026-04-29T11:56:07Z","snapshot_observed_at":"2026-08-02T22:37:43.671163Z","submitted_at":"2026-04-29T11:56:07Z","title":"PAINT: Partial-Solution Adaptive Interpolated Training for Self-Distilled Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26573","snapshot_observed_at":"2026-08-14T04:33:46.008337Z","title":"arXiv preprint arXiv:2604.26573 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.008337Z"},"links":{"cited_paper":"/paper/2604.26573","citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:c563ab088de463db19b976f44254aabf67613b3b890fc95ee5f1827d203195a4","observation_id":"42214a55-8b35-42b2-be07-e5d145268907","resolution":{"observed_at":"2026-08-14T04:33:46.008337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21606","last_updated":"2026-05-20T18:14:03Z","snapshot_observed_at":"2026-08-12T00:58:13.334263Z","submitted_at":"2026-05-20T18:14:03Z","title":"When Are Teacher Tokens Reliable? Position-Weighted On-Policy Self-Distillation for Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21606","snapshot_observed_at":"2026-08-14T04:33:46.012744Z","title":"arXiv preprint arXiv:2605.21606 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.012744Z"},"links":{"cited_paper":"/paper/2605.21606","citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:da52fae252a960d1fbed68b180bb7fedd6692f956abb37719524e024969f3d7e","observation_id":"78962215-ea98-4859-997c-c87618b30e5f","resolution":{"observed_at":"2026-08-14T04:33:46.012744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.26844","last_updated":"2026-05-26T10:56:46Z","snapshot_observed_at":"2026-08-08T04:38:50.480074Z","submitted_at":"2026-05-26T10:56:46Z","title":"Not All Disagreement Is Learnable: Token Teachability in On-Policy Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.26844","snapshot_observed_at":"2026-08-14T04:33:46.016987Z","title":"arXiv preprint arXiv:2605.26844 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.016987Z"},"links":{"cited_paper":"/paper/2605.26844","citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:f5930931878f6f1c681ff577d95ecf4cf50f46d02187c574f638bd474d5ebab3","observation_id":"77697ba3-967a-4cbb-9b13-5bdd99f5eb81","resolution":{"observed_at":"2026-08-14T04:33:46.016987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:46.311016Z","title":"Neural Networks , volume=","venue":null,"work_id":"f38cc310-9cb7-43aa-8826-eed7691c0c0e","year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.026933Z"},"links":{"citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:9f91306fada6f8a0162f1114f80ef71af981794a79a37102bb008dbc68ce8fdd","observation_id":"2122f2a1-30ed-4a49-a536-1b19fb9431cd","resolution":{"observed_at":"2026-08-14T04:33:46.319066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:46.295681Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"4550475f-c8a8-421c-bcbb-53c376603fcf","year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.031511Z"},"links":{"citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:8b032e3a5e060c9064bccd57fe5e1aae853f76767b4597f23b06550039562964","observation_id":"f3884fc4-2917-42a9-8aa3-3105c1f3a670","resolution":{"observed_at":"2026-08-14T04:33:46.299761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:46.038190Z","title":"IEEE Transactions on Information Theory , volume=","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.038190Z"},"links":{"citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:5fc769686cd28ddada6b8df7e48fdc90963e4aace0391264060f80c76db47c98","observation_id":"1f676d48-03aa-410b-9751-659b4a8db8c8","resolution":{"observed_at":"2026-08-14T04:33:46.038190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:46.277414Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":"924d446f-d5cc-429d-8477-01e1c27791ae","year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.042301Z"},"links":{"citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:3c60e0a38b6875cfb0cfface9caab2858eec75aeb934542c1c27b2081d15fd3e","observation_id":"d38a038d-1b38-4ea7-bef5-9668493367eb","resolution":{"observed_at":"2026-08-14T04:33:46.281226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:46.046172Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.046172Z"},"links":{"citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:0367d9c32aa9e2b594a5fe25411fa21e50efa7409814239c83110e8c08f2561b","observation_id":"6ef0ca26-cfa3-48c4-b456-bbe66c727138","resolution":{"observed_at":"2026-08-14T04:33:46.046172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:46.258592Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"99234072-d921-4195-80a4-814ae7af8d64","year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.050089Z"},"links":{"citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:8a4a8b1de9051ef648ac6ec76668fe82f7c07c68d37429365643a59c225de3fe","observation_id":"212a28fb-1fdd-4c89-838b-2ce13f4ceb0f","resolution":{"observed_at":"2026-08-14T04:33:46.262805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:33:46.245383Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":"6d1f2be1-0a20-47df-a106-a6168def9ac8","year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.053781Z"},"links":{"citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:8bac168afa9e2c9099331e3bcf19eacecb29b3464be62c4f5740e4aa32f5695f","observation_id":"c75b8304-27a5-4a0e-8e02-76243d331fbd","resolution":{"observed_at":"2026-08-14T04:33:46.249303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-14T04:33:46.058665Z","title":"arXiv preprint arXiv:2402.03300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T04:33:46.058665Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.08726"},"observation_digest":"sha256:11000cbe4d715edc2659843003c71e85c8fc18f1841d3a66f76639633b78194f","observation_id":"7fbbd9af-c66a-4e59-8285-3eeb036dca0b","resolution":{"observed_at":"2026-08-14T04:33:46.058665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.08726","last_updated":"2026-08-09T14:20:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T04:48:08.344276Z","submitted_at":"2026-08-09T14:20:12Z","title":"PAST: Privileged Adaptation from Complete Student Trajectories for On-Policy Self-Distillation"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2608.08726."}