{"as_of":"2026-08-06T15:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:28785f0135a330952f5d8bb57b1be298b1322af1e3dc02cd649686f9ca2111b8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":37,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:15:50.848819Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":7,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2210.11610","last_updated":"2022-10-25T17:45:17Z","snapshot_observed_at":"2026-07-06T14:08:26.493996Z","submitted_at":"2022-10-20T21:53:54Z","title":"Large Language Models Can Self-Improve","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T17:00:48.167441Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2210.11610"},"observation_digest":"sha256:f4d1817201b07de1911aba6821ce6a89cc627828a260b747a8c0ad311987eb6a","observation_id":"6315a156-3a7e-4e8f-8087-f5ed01a82869","resolution":{"observed_at":"2026-05-18T17:00:48.263694Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2404.13208","last_updated":"2024-04-19T22:55:23Z","snapshot_observed_at":"2026-08-02T11:48:17.206729Z","submitted_at":"2024-04-19T22:55:23Z","title":"The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T10:59:30.728091Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2404.13208"},"observation_digest":"sha256:e1fb4de33eedee2fce632b2db4479fd40b25b489264c885e60067a2fb0ff6866","observation_id":"8a76589d-0a1a-49f6-b3ab-3bce8130e323","resolution":{"observed_at":"2026-05-12T10:59:30.789754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2406.10162","last_updated":"2024-06-29T00:28:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-14T16:26:20Z","title":"Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models","version":3},"reference_index":297,"source":"arxiv_source","source_observed_at":"2026-05-17T14:43:29.496457Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2406.10162"},"observation_digest":"sha256:a9d99858aabcdb8b4b3970843d6e975dea35385e06fcb001be7880000df2a2aa","observation_id":"7c63712a-c751-46c4-8876-d99ce7a1cfde","resolution":{"observed_at":"2026-05-17T14:43:29.847490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2604.07894","last_updated":"2026-04-09T07:04:19Z","snapshot_observed_at":"2026-08-04T00:00:08.854253Z","submitted_at":"2026-04-09T07:04:19Z","title":"TSUBASA: Improving Long-Horizon Personalization via Evolving Memory and Self-Learning with Context Distillation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-10T16:48:53.092395Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2604.07894"},"observation_digest":"sha256:fdaa784551f9888865bb2c20b680339d1c9b892dc38678c4535043661b37c17c","observation_id":"50903d1d-fcc2-4a71-87ca-4b368a71f632","resolution":{"observed_at":"2026-05-11T08:06:01.325654Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2604.07941","last_updated":"2026-04-16T04:43:04Z","snapshot_observed_at":"2026-08-02T07:24:04.075021Z","submitted_at":"2026-04-09T08:00:37Z","title":"Large Language Model Post-Training: A Unified View of Off-Policy and On-Policy Learning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T18:28:58.515666Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2604.07941"},"observation_digest":"sha256:ef87f521e280ee0563c04424232604207136006499abebc6ff48ddb086e7c7b2","observation_id":"6b05a7e0-2cd5-41ea-9ae2-83ab31691c93","resolution":{"observed_at":"2026-05-11T00:30:53.811574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2604.09571","last_updated":"2026-02-20T13:35:43Z","snapshot_observed_at":"2026-08-06T13:37:26.923687Z","submitted_at":"2026-02-20T13:35:43Z","title":"Tuning Qwen2.5-VL to Improve Its Web Interaction Skills","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T20:51:00.660022Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2604.09571"},"observation_digest":"sha256:4adaa7bdaa262b72904c6cd67feb7ab4449fd32d05985828f7d02607b4cfcf39","observation_id":"390f6538-ff00-4411-b80c-8a8ba392cbc8","resolution":{"observed_at":"2026-05-15T20:51:36.168174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2604.20733","last_updated":"2026-04-22T16:20:41Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T16:20:41Z","title":"Near-Future Policy Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T00:51:36.580600Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2604.20733"},"observation_digest":"sha256:aec24b8364d00368673eda45b644b90eb415fefca9394ad9c71b10ef3720dd16","observation_id":"bc112bd6-1564-4118-b3f7-1c480e323da7","resolution":{"observed_at":"2026-05-10T00:54:48.621807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.07307","last_updated":"2026-05-08T06:15:50Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:15:50Z","title":"Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-11T02:11:19.295354Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.07307"},"observation_digest":"sha256:5ebf90ac1748df0ce0b031576b59881ab968eb3cb87d97bc830184573f7a31fb","observation_id":"23e15da8-ae9f-4e89-a077-959b1c3a9c0f","resolution":{"observed_at":"2026-05-11T03:50:57.396716Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.08873","last_updated":"2026-05-09T10:51:58Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T10:51:58Z","title":"CoDistill-GRPO: A Co-Distillation Recipe for Efficient Group Relative Policy Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-12T00:59:44.364491Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.08873"},"observation_digest":"sha256:bd1f88f16690db02e8f2470095104597d436fd3b65edfe36d8dc40836db2755c","observation_id":"0d3e8055-9993-4172-b246-d8d7ee956d9c","resolution":{"observed_at":"2026-05-12T08:31:26.461256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.10889","last_updated":"2026-05-11T17:33:28Z","snapshot_observed_at":"2026-07-06T23:22:47.781940Z","submitted_at":"2026-05-11T17:33:28Z","title":"Unmasking On-Policy Distillation: Where It Helps, Where It Hurts, and Why","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-12T04:28:58.679078Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.10889"},"observation_digest":"sha256:b5015f03d4f03fdf83fd1e1714299ade0de488cb0f94ae764faad2180fe02f53","observation_id":"2f30f395-0463-46f1-8409-6420710e6aed","resolution":{"observed_at":"2026-05-12T06:11:27.211928Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.11613","last_updated":"2026-05-12T06:43:17Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:43:17Z","title":"From Generic Correlation to Input-Specific Credit in On-Policy Self Distillation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T01:24:34.093541Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.11613"},"observation_digest":"sha256:a6ea6e408f90cc70ad6473a2972fddb42cc924f215c6b95dccc602258e759c11","observation_id":"fe2f5de1-d1ce-4a95-88cd-496aadba5cd3","resolution":{"observed_at":"2026-05-13T01:27:02.004969Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.15604","last_updated":"2026-05-15T04:31:06Z","snapshot_observed_at":"2026-07-06T23:26:51.110846Z","submitted_at":"2026-05-15T04:31:06Z","title":"VSPO: Vector-Steered Policy Optimization for Behavioral Control","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T19:39:55.294398Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.15604"},"observation_digest":"sha256:d9038169b25e222c76e03ebbc1d8e8cf68dd2d08502820e413a3b9d8a524d9cd","observation_id":"8d283293-324b-431b-a553-37de5b1c0d88","resolution":{"observed_at":"2026-05-20T19:43:44.111000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.17497","last_updated":"2026-05-17T15:14:24Z","snapshot_observed_at":"2026-08-05T13:27:59.292796Z","submitted_at":"2026-05-17T15:14:24Z","title":"Self-Supervised On-Policy Distillation for Reasoning Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-20T14:42:55.368104Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.17497"},"observation_digest":"sha256:08cf20bee50bdc450943bd15b1e01c4d96c9076e44ee1658b00a0bce0fd1f2b5","observation_id":"f2e52020-fd83-41d3-9150-d734f9a25543","resolution":{"observed_at":"2026-05-20T14:43:21.837694Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.18226","last_updated":"2026-05-18T11:12:45Z","snapshot_observed_at":"2026-07-06T23:29:09.538843Z","submitted_at":"2026-05-18T11:12:45Z","title":"Context Memorization for Efficient Long Context Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T10:39:09.720412Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.18226"},"observation_digest":"sha256:5ec5831d8db63edb06bea8461adba8244d89bf6596757b7dc1c1e01aed956867","observation_id":"c684b1c3-bc07-4859-bff8-e44a0c0ec5e9","resolution":{"observed_at":"2026-05-20T10:43:12.621794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.20258","last_updated":"2026-05-18T13:57:44Z","snapshot_observed_at":"2026-08-01T15:49:54.836496Z","submitted_at":"2026-05-18T13:57:44Z","title":"It Takes Two: Complementary Self-Distillation for Contextual Integrity in LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T08:05:44.358256Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.20258"},"observation_digest":"sha256:c4e142a85598e401154a20d970eec37182cb3aff8fab273efe09b8173850aa5c","observation_id":"aead6aed-ce7e-46bc-9f79-d599385a5c80","resolution":{"observed_at":"2026-05-21T08:09:51.844225Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.22263","last_updated":"2026-05-21T10:07:46Z","snapshot_observed_at":"2026-08-02T10:25:42.509450Z","submitted_at":"2026-05-21T10:07:46Z","title":"Tailoring Teaching to Aptitude: Direction-Adaptive Self-Distillation for LLM Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T08:06:30.862911Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.22263"},"observation_digest":"sha256:ac597827f9d2b08ca62bbaa9b1672a117b2c2aad229d1ca2b64b0d8e1b47fd0f","observation_id":"c02f2b1f-98f7-48ae-a4be-57807067c3f1","resolution":{"observed_at":"2026-05-22T08:11:17.794411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2605.26099","last_updated":"2026-06-05T05:36:49Z","snapshot_observed_at":"2026-07-06T23:36:01.564747Z","submitted_at":"2026-05-25T17:55:39Z","title":"Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T21:37:51.638904Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2605.26099"},"observation_digest":"sha256:59c149824ac16ae40ea1082cc7f2379ad0e0f222999bcda09d93dd128cbb9275","observation_id":"e0a87535-1268-4e94-a7ce-4f26e4217fc5","resolution":{"observed_at":"2026-06-29T21:43:59.454603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.01080","last_updated":"2026-05-31T07:57:45Z","snapshot_observed_at":"2026-08-03T19:26:59.405434Z","submitted_at":"2026-05-31T07:57:45Z","title":"ThinkSwitch: Context Distillation with LoRA and Weight Interpolation for Specific-Purpose Reasoning Tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-28T17:52:59.979543Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.01080"},"observation_digest":"sha256:70d3498933348ce92b81be6a91f89dece77e53907fde10ff10709a99cf866ce6","observation_id":"9f489a76-dc34-4a8f-8804-8a86246c3e36","resolution":{"observed_at":"2026-06-28T18:02:27.323880Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.04703","last_updated":"2026-06-03T10:30:09Z","snapshot_observed_at":"2026-07-06T23:44:47.848374Z","submitted_at":"2026-06-03T10:30:09Z","title":"Rethinking Continual Experience Internalization for Self-Evolving LLM Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-28T06:29:11.398007Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.04703"},"observation_digest":"sha256:704ac6f881fc3d9365957a3503ace9de606b5dc21b928bcf24ba758d5f02aea1","observation_id":"a27e4b2b-54bf-489c-97b7-9ffcc22ee17e","resolution":{"observed_at":"2026-07-02T07:56:47.807293Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.06154","last_updated":"2026-06-04T13:28:48Z","snapshot_observed_at":"2026-08-03T18:23:02.874306Z","submitted_at":"2026-06-04T13:28:48Z","title":"Amortizing Federated Adaptation: Hypernetwork Driven LoRA for Personalized Foundation Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-28T01:27:04.241484Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.06154"},"observation_digest":"sha256:1b4b3bba740a12fd39ec40ed1981c99c46f8fccd0a299696e6df0852a169e5bd","observation_id":"df9f27f8-938f-4796-91dc-a98b8b99672d","resolution":{"observed_at":"2026-07-02T13:16:58.682443Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.11853","last_updated":"2026-06-10T09:30:25Z","snapshot_observed_at":"2026-08-02T20:07:37.622537Z","submitted_at":"2026-06-10T09:30:25Z","title":"Task-Aware Structured Memory for Dynamic Multi-modal In-Context Learning","version":1},"reference_index":205,"source":"arxiv_source","source_observed_at":"2026-06-27T10:28:11.440915Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.11853"},"observation_digest":"sha256:ca9dbb71e16c6f46135290ab0d112b497403aeca37976481d00481800b207eb4","observation_id":"2a5df5e2-4795-432a-a14d-fe02e61050d1","resolution":{"observed_at":"2026-07-03T09:17:48.415598Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.12400","last_updated":"2026-06-10T17:58:20Z","snapshot_observed_at":"2026-07-06T23:51:22.219590Z","submitted_at":"2026-06-10T17:58:20Z","title":"Doc-to-Atom: Learning to Compile and Compose Memory Atoms","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T09:53:35.191873Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.12400"},"observation_digest":"sha256:4d85657b7d8330bb0747e4f5fff158dd6fb1933b6107cf2557efdace0a203e91","observation_id":"e8b6433a-3038-4a7e-a9f2-ffffa1b77373","resolution":{"observed_at":"2026-07-03T10:37:57.065542Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.12942","last_updated":"2026-06-11T06:09:51Z","snapshot_observed_at":"2026-08-02T20:26:56.141213Z","submitted_at":"2026-06-11T06:09:51Z","title":"PRISMR: Overcoming Parse Collapse in Multimodal Listwise Ranking via Parameterized Representation Internalization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T07:00:17.978103Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.12942"},"observation_digest":"sha256:b6a4ed02b536c399b6ca11f35886275920fdf156afd959d1012253485ef21280","observation_id":"59ec0084-5f5e-4a98-b02b-9789f1e586ad","resolution":{"observed_at":"2026-07-03T14:38:29.012031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-07-12T13:53:50.979339Z","title":"Learning by Distilling Context","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.16149","last_updated":"2026-07-09T08:06:50Z","snapshot_observed_at":"2026-08-02T19:24:51.303810Z","submitted_at":"2026-06-15T03:10:17Z","title":"LiteOdyssey: A Lightweight Reasoning AI Agent for Interpretable Rare-Disease Diagnosis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T13:53:50.979339Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.16149"},"observation_digest":"sha256:6718ef00250e1581a5405cd12e5240227d43ae3f6840bbfa78cea3525e4d250e","observation_id":"1e7fea36-569e-4851-a290-89d780eaa74c","resolution":{"observed_at":"2026-07-12T13:53:50.979339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.28349","last_updated":"2026-06-03T07:15:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-03T07:15:11Z","title":"HMARS: A Hierarchical Multi-Agent Memory System for Long-Context Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-30T11:30:52.871762Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.28349"},"observation_digest":"sha256:8f80bbcfd975ab252e31af3bba02d56edcc69a0b8f5051c68d622c2a906ae993","observation_id":"5dd966a1-a03d-4b16-8ed1-aaccc18458a8","resolution":{"observed_at":"2026-06-30T11:34:37.890032Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2606.30775","last_updated":"2026-06-29T18:06:43Z","snapshot_observed_at":"2026-07-07T00:04:34.491408Z","submitted_at":"2026-06-29T18:06:43Z","title":"A Single Rewrite Suffices: Empirical Lessons from Production Skill Description Optimization","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-01T02:32:19.425550Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2606.30775"},"observation_digest":"sha256:fc44bb6880fc3aaae1545a0d538f5a580b8829a214ce20c044b26c1afae42f50","observation_id":"6ad6097b-b6b7-458b-870b-41f3ce6d15c3","resolution":{"observed_at":"2026-07-01T12:05:43.607060Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2607.01208","last_updated":"2026-07-01T17:46:33Z","snapshot_observed_at":"2026-07-07T00:06:49.412663Z","submitted_at":"2026-07-01T17:46:33Z","title":"Distill to Detect: Exposing Stealth Biases in LLMs through Cartridge Distillation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-02T12:27:59.332432Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.01208"},"observation_digest":"sha256:bfe0c49ed89990379f35ac86c528107f4d95d7888118d25d59810f8226337131","observation_id":"c08528f8-3569-4cad-b504-2a86a7fb4596","resolution":{"observed_at":"2026-07-02T12:36:56.170129Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2607.01690","last_updated":"2026-07-02T04:31:41Z","snapshot_observed_at":"2026-08-02T22:45:02.076056Z","submitted_at":"2026-07-02T04:31:41Z","title":"Epistemic Goggles: A Pretrained Module that Induces an Epistemic Frame via Gradient Editing","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-03T14:25:39.401131Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.01690"},"observation_digest":"sha256:afcdc7545847571a6fc68bba052726c565513c8245d76bd95302dbe08dc9ffb7","observation_id":"ccca42a2-76c5-4d5d-b4ce-89280ded27cd","resolution":{"observed_at":"2026-07-03T14:28:31.104704Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":"2209.15189","doi":"10.48550/arxiv.2209.15189","metadata_source":"pith","pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning by distilling context","venue":"cs.CL","work_id":"154b4a90-a354-4ade-92a0-d166d944e9e2","year":2022},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:795d3bf8d387b7ad8a6e443fbb25b246085d0661c2e2ba604533188c7f1b7307","observation_id":"705eea4c-835b-4c44-8dac-9d3fa8fca4d3","resolution":{"observed_at":"2026-07-10T01:36:44.163623Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:46.165167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-07-14T07:36:43.499258Z","title":"Learning by distilling context.arXiv preprint arXiv:2209.15189,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11020","last_updated":"2026-07-14T05:59:33Z","snapshot_observed_at":"2026-08-05T22:32:33.467630Z","submitted_at":"2026-07-13T02:39:38Z","title":"Can a Language Model Learn Facts Continually in Its Weights?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T07:36:43.499258Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.11020"},"observation_digest":"sha256:a646bf397ea0a6b6308278f2d365d57070897b124f87cd55af29effc23b3e9b5","observation_id":"8f316d1a-e5dd-451f-915c-2364c8772c32","resolution":{"observed_at":"2026-07-14T07:36:43.499258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-01T08:43:21.932131Z","title":"Charlie Snell, Dan Klein, and Ruiqi Zhong","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21051","last_updated":"2026-07-23T08:34:31Z","snapshot_observed_at":"2026-08-06T05:40:07.686369Z","submitted_at":"2026-07-23T08:34:31Z","title":"Sample-Efficient Learning from Agent Experience","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T08:43:21.932131Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.21051"},"observation_digest":"sha256:690daa0f5249c4afbd41498b3bd8c627f489f970b12c73c3543342c28ee92402","observation_id":"7f4310bc-91e5-42bf-8c39-a8b170fc4602","resolution":{"observed_at":"2026-08-01T08:43:21.932131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-02T08:17:26.367813Z","title":"arXiv preprint arXiv:2209.15189 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21627","last_updated":"2026-07-07T22:31:23Z","snapshot_observed_at":"2026-08-05T14:59:17.282844Z","submitted_at":"2026-07-07T22:31:23Z","title":"Do Modules Stay in Their Lane? Role Drift in Compound LLM Systems","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T08:17:26.367813Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.21627"},"observation_digest":"sha256:317e57cda8ae3bea5be94c7d02803450399eca4cb5e09076079d6fa7b39b2804","observation_id":"b9d82d3a-535f-425f-8fd3-486c7f062d7e","resolution":{"observed_at":"2026-08-02T08:17:26.367813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-01T06:19:33.044773Z","title":"arXiv:2209.15189","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21943","last_updated":"2026-07-29T05:22:33Z","snapshot_observed_at":"2026-08-05T06:19:44.057874Z","submitted_at":"2026-07-24T03:39:34Z","title":"Listen, Do Not Copy: Internalizing Audio-Grounded Scaffold Context for Robust Omni-Model Speech Understanding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:33.044773Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.21943"},"observation_digest":"sha256:42e827594dd969b6e426f498344604fba84a1433938a3e1a2303ee5ba6f32ef5","observation_id":"e6c8895e-7140-4b0d-9c91-a653f644cb73","resolution":{"observed_at":"2026-08-01T06:19:33.044773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-02T10:49:24.977221Z","title":"Learning by distilling context.arXiv preprint arXiv:2209.15189, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22629","last_updated":"2026-06-18T21:19:38Z","snapshot_observed_at":"2026-08-06T02:13:49.868754Z","submitted_at":"2026-06-18T21:19:38Z","title":"Masked Distillation: Internalizing the Chain-of-Thought in Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T10:49:24.977221Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.22629"},"observation_digest":"sha256:de04519c3b7bf1c6f6e501b3c2077f5317d62a59623a535b5961e94d27ce88ce","observation_id":"7bad19ac-b647-4b4c-ab95-a94ab1ce032d","resolution":{"observed_at":"2026-08-02T10:49:24.977221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-07-31T20:13:02.033825Z","title":"Learning by distilling context.CoRR, abs/2209.15189, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28022","last_updated":"2026-07-30T11:11:32Z","snapshot_observed_at":"2026-08-05T16:02:24.375797Z","submitted_at":"2026-07-30T11:11:32Z","title":"Flux-OPD: On-Policy Distillation with Evolving Contexts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T20:13:02.033825Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2607.28022"},"observation_digest":"sha256:968167e7af7a8c9f5f2c82a4187a160d20334c518ff2e13197350094c58c5d75","observation_id":"f34e8e4d-f88c-43da-a22c-1dd43c616bee","resolution":{"observed_at":"2026-07-31T20:13:02.033825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-04T23:14:10.159095Z","title":"Learning by distilling context.arXiv preprint arXiv:2209.15189, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01672","last_updated":"2026-08-03T04:06:06Z","snapshot_observed_at":"2026-08-06T14:25:06.177815Z","submitted_at":"2026-08-03T04:06:06Z","title":"Learning What to Remember: Test-Time Training via Context Distillation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T23:14:10.159095Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2608.01672"},"observation_digest":"sha256:768d8e27381e6a0ee6ebdca5c01e702694c169cfb7e15ece10522e98242db24e","observation_id":"d702b95c-08f7-4a5f-ae0c-2adbb5ce5d7b","resolution":{"observed_at":"2026-08-04T23:14:10.159095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15189","snapshot_observed_at":"2026-08-05T23:15:50.848819Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03223","last_updated":"2026-08-04T06:56:47Z","snapshot_observed_at":"2026-08-06T14:31:27.311775Z","submitted_at":"2026-08-04T06:56:47Z","title":"Agentic Reinforcement Learning with Self-Distilled Reward Shaping","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:15:50.848819Z"},"links":{"cited_paper":"/paper/2209.15189","citing_paper":"/paper/2608.03223"},"observation_digest":"sha256:18eab4f9f5dc58935d1a1b6acc28057b5f0ab7e83a6e5f5890f10dc85fcf23f2","observation_id":"ff8d01c5-2bd5-42d1-9e20-50c0d9be4d9a","resolution":{"observed_at":"2026-08-05T23:15:50.848819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2209.15189/citation-record","integrity":"/paper/2209.15189/integrity","json":"/paper/2209.15189/citation-record.json","paper":"/paper/2209.15189"},"outbound":[],"paper":{"arxiv_id":"2209.15189","last_updated":"2022-09-30T02:30:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T09:41:45.042008Z","submitted_at":"2022-09-30T02:30:15Z","title":"Learning by Distilling Context"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 37 inbound Pith citation observations for arXiv:2209.15189."}