{"as_of":"2026-08-13T02:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b101ec8de563f59a0b9e55761f4304510f24dde72621bdb20ba5f950a5b2321","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T03:27:50.454980Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T22:47:05.132020Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T22:48:22.886654Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"cited_work":{"arxiv_id":"2602.08222","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.08222","snapshot_observed_at":"2026-06-09T03:07:11.059756Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","venue":null,"work_id":"504ce3f1-7085-4c71-ac7e-a61bc692cbcc","year":2026},"citing_paper":{"arxiv_id":"2604.00860","last_updated":"2026-07-07T13:24:35Z","snapshot_observed_at":"2026-08-12T02:20:10.617848Z","submitted_at":"2026-04-01T13:10:20Z","title":"Policy Improvement Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T22:47:05.132020Z"},"links":{"cited_paper":"/paper/2602.08222","citing_paper":"/paper/2604.00860"},"observation_digest":"sha256:395aa614067efe2668bc65c68a75b44337966e5fa0fb3c40a4543b76fc8cdbfd","observation_id":"5075ea1c-cdf2-4e45-8eb5-1cf11b959a1d","resolution":{"observed_at":"2026-06-09T03:07:11.059756Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.08222/citation-record","integrity":"/paper/2602.08222/integrity","json":"/paper/2602.08222/citation-record.json","paper":"/paper/2602.08222"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:27:50.401394Z","title":"Pre” denotes before joint training, and “Stronger (Post)","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:50.401394Z"},"links":{"citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:bacad17c7572991eff1637e3f89ca28989b0629b46c94f44015d846da75a1080","observation_id":"59fa4573-ea50-4015-ac82-d0c550a352f8","resolution":{"observed_at":"2026-08-03T03:27:50.401394Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10052","last_updated":"2024-10-16T11:50:27Z","snapshot_observed_at":"2026-08-09T14:02:07.168943Z","submitted_at":"2024-02-15T16:21:14Z","title":"UNDIAL: Self-Distillation with Adjusted Logits for Robust Unlearning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10052","snapshot_observed_at":"2026-08-03T03:27:48.463612Z","title":"How abilities in large language models are affected by supervised fine-tuning data composition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.463612Z"},"links":{"cited_paper":"/paper/2402.10052","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:e7fb64b4023c4a23f504aae562bf0bd0391cb4f8b2cb5e62a54d4db363f9d3df","observation_id":"7d97815c-8e84-490e-901e-ad17479804e2","resolution":{"observed_at":"2026-08-03T03:27:48.463612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08543","last_updated":"2026-01-31T09:16:35Z","snapshot_observed_at":"2026-08-12T06:56:18.267828Z","submitted_at":"2023-06-14T14:44:03Z","title":"MiniLLM: On-Policy Distillation of Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08543","snapshot_observed_at":"2026-08-03T03:27:48.534063Z","title":"doi: 10.1007/s11263-021-01453-z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.534063Z"},"links":{"cited_paper":"/paper/2306.08543","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:184c501008f90ca53e4609329941f89bd931249537210c4f28be1e49e92d2314","observation_id":"f6084749-5a4c-4117-8136-fda46866aa78","resolution":{"observed_at":"2026-08-03T03:27:48.534063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15717","last_updated":"2023-05-25T05:00:12Z","snapshot_observed_at":"2026-08-12T18:39:37.539896Z","submitted_at":"2023-05-25T05:00:12Z","title":"The False Promise of Imitating Proprietary LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15717","snapshot_observed_at":"2026-08-03T03:27:48.597536Z","title":"Gulcehre, C., Paine, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.597536Z"},"links":{"cited_paper":"/paper/2305.15717","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:ee973165c83508f6624564b8601186b074e575a841c64eac8a4fb8b364f059fb","observation_id":"5b682dd4-53a1-47d8-b5fe-33ba85abf028","resolution":{"observed_at":"2026-08-03T03:27:48.597536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08998","last_updated":"2023-08-21T10:23:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-17T14:12:48Z","title":"Reinforced Self-Training (ReST) for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08998","snapshot_observed_at":"2026-08-03T03:27:48.664337Z","title":"He, X., Ban, Y ., Zou, J., Wei, T., Cook, C., and He, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.664337Z"},"links":{"cited_paper":"/paper/2308.08998","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:7ca3bae886b0faf83c0d1a0dda7fea7ee103d9c2020c975948a96cae5f367427","observation_id":"3526dbb3-d001-47dc-9941-6a34fbb45d75","resolution":{"observed_at":"2026-08-03T03:27:48.664337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-03T03:27:48.724872Z","title":"Distilling the knowledge in a neural network.arXiv preprint arXiv:1503.02531,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.724872Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:a58667959e28a0b821f6def5b9585fb1731aef429fc06eda2a562a075e45ac84","observation_id":"724c113c-9907-46df-8fb4-9ce810d66487","resolution":{"observed_at":"2026-08-03T03:27:48.724872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05914","last_updated":"2023-10-10T17:31:00Z","snapshot_observed_at":"2026-08-12T05:13:32.551469Z","submitted_at":"2023-10-09T17:58:34Z","title":"NEFTune: Noisy Embeddings Improve Instruction Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05914","snapshot_observed_at":"2026-08-03T03:27:49.024742Z","title":"Koncel-Kedziorski, R., Roy, S., Amini, A., Kushman, N., and Hajishirzi, H","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:49.024742Z"},"links":{"cited_paper":"/paper/2310.05914","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:3cdb35715c4a438fa3eff62c607cc2b70752a35b6b4f5d9498010f30fdf94b07","observation_id":"c0e0a2ae-74d4-4925-a499-82e9d139bc74","resolution":{"observed_at":"2026-08-03T03:27:49.024742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08115","last_updated":"2024-08-03T21:25:31Z","snapshot_observed_at":"2026-08-10T01:47:55.445525Z","submitted_at":"2024-02-12T23:11:01Z","title":"On the Self-Verification Limitations of Large Language Models on Reasoning and Planning Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08115","snapshot_observed_at":"2026-08-03T03:27:49.384386Z","title":"org/abs/2402.08115","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:49.384386Z"},"links":{"cited_paper":"/paper/2402.08115","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:03223db34e0e888ab68e4a00ab3b3165096f3624aa66ed9eed7c7d1216894993","observation_id":"67026650-d548-407c-b6e3-251e952190cf","resolution":{"observed_at":"2026-08-03T03:27:49.384386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-11T20:57:48.098709Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-03T03:27:49.509414Z","title":"Wizardlm: Empowering large language models to follow complex instructions.arXiv preprint arXiv:2304.12244,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:49.509414Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:9caf66c1f43886de412c351a5514fd5fb12d41ccd2ba71c8f07a623c3e5545bb","observation_id":"ce582407-695a-48b4-a401-ca4e7122c79e","resolution":{"observed_at":"2026-08-03T03:27:49.509414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T03:27:49.668034Z","title":"Yang, F., Chen, Z., Wang, X., Lu, X., Chai, J., Yin, G., Lin, W., Ma, S., Zhuang, F., Wang, D., Yang, Y ., Li, J., and Ban, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:49.668034Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:c05863eef6f414483a8700e4e4f2a2680d6c4b061fcc00290cad38e85aaca413","observation_id":"86d6066e-9e7d-4323-a480-4914ae995cd8","resolution":{"observed_at":"2026-08-03T03:27:49.668034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:27:49.855213Z","title":"Zhang, L., Song, J., Gao, A., Chen, J., Bao, C., and Ma, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:49.855213Z"},"links":{"citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:7b82ae4896593b3f641a9b13a50f021b7c04dc8c90701ec55fc6b31b63b47d23","observation_id":"847763be-7e44-4c1e-9a08-4e48fa62f5fd","resolution":{"observed_at":"2026-08-03T03:27:49.855213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19633","last_updated":"2025-03-25T13:19:46Z","snapshot_observed_at":"2026-08-12T22:48:57.315672Z","submitted_at":"2025-03-25T13:19:46Z","title":"1.4 Million Open-Source Distilled Reasoning Dataset to Empower Large Language Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19633","snapshot_observed_at":"2026-08-03T03:27:50.171399Z","title":"Zhou, C., Liu, P., Xu, P., Iyer, S., Sun, J., Mao, Y ., Ma, X., Efrat, A., Yu, P., Yu, L., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:50.171399Z"},"links":{"cited_paper":"/paper/2503.19633","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:608de13c7bb9eded6aeb85fc12cf6207612bbcc5dbc4962cf65b7fcb32c2e295","observation_id":"b8ec002e-4c1d-4fad-ac9f-2e3ae9a599dc","resolution":{"observed_at":"2026-08-03T03:27:50.171399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:27:50.268899Z","title":"Transformer copilot: Learning from the mistake log in llm fine-tuning.arXiv preprint arXiv:2505.16270,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:50.268899Z"},"links":{"citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:69584649fc9e690afc7eacbff56699e628d73ab6f1688686ef39b505415ffe3a","observation_id":"efaa566f-0fc5-4a8d-9bf9-4fe0d3b1d0e0","resolution":{"observed_at":"2026-08-03T03:27:50.268899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:27:50.311246Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:50.311246Z"},"links":{"citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:749cf63612a31814eeb98021efd940e5f00f648d3f0c5bdea61b68c69d2c2042","observation_id":"241cde0f-c00f-40d5-9061-76f59cdd8b0c","resolution":{"observed_at":"2026-08-03T03:27:50.311246Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:27:50.454980Z","title":"To answer the user’s question, you first think about the reasoning process and then provide the user with the answer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:50.454980Z"},"links":{"citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:a4ce7b199004942f899aec9f14c98b634d611fdaeb3762e985bbb9efb8873c32","observation_id":"29d6226e-7335-4ca8-9378-126e17829fbc","resolution":{"observed_at":"2026-08-03T03:27:50.454980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:27:50.342387Z","title":"Configuration C (α= 0.1, β= 0.9, γ= 0), which disables the regression-repair signal, achieves the highest accuracy on MATH 500 (70.2%)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":500,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:50.342387Z"},"links":{"citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:d1db1ee8965f45fa34d6c41f0e87b4d77fc9e9cde86eb0150bf3abb968d62028","observation_id":"8cb47913-d6bd-4bdc-8d4a-23c21298a438","resolution":{"observed_at":"2026-08-03T03:27:50.342387Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09390","last_updated":"2023-12-14T23:07:33Z","snapshot_observed_at":"2026-07-06T17:02:09.539730Z","submitted_at":"2023-12-14T23:07:33Z","title":"Weak-to-Strong Generalization: Eliciting Strong Capabilities With Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09390","snapshot_observed_at":"2026-08-03T03:27:48.234476Z","title":"H., Baker, B., Gao, L., Aschenbrenner, L., Chen, Y ., Ecoffet, A., Joglekar, M., Leike, J., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.234476Z"},"links":{"cited_paper":"/paper/2312.09390","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:ae71f0fafeac15189f3d998e467abdf67d372e76c90087e0f2e6feff5250acaa","observation_id":"f44f265f-9029-492d-95e7-20521ee0881d","resolution":{"observed_at":"2026-08-03T03:27:48.234476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.04146","last_updated":"2017-10-23T16:45:03Z","snapshot_observed_at":"2026-08-02T16:52:38.363314Z","submitted_at":"2017-05-11T13:04:47Z","title":"Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.04146","snapshot_observed_at":"2026-08-03T03:27:49.162370Z","title":"Pro- gram induction by rationale generation: Learning to solve and explain algebraic word problems.arXiv preprint arXiv:1705.04146,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:49.162370Z"},"links":{"cited_paper":"/paper/1705.04146","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:27d5fa84366712e46cac1445a7cb9d6d258dff44d6cbb6d6cf5a07c5ecd0d36b","observation_id":"6ecea6dc-8ded-41bd-ba4f-6cf9a04ca6f2","resolution":{"observed_at":"2026-08-03T03:27:49.162370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.08094","last_updated":"2019-05-17T08:46:50Z","snapshot_observed_at":"2026-07-06T07:54:10.798256Z","submitted_at":"2019-05-17T08:46:50Z","title":"Be Your Own Teacher: Improve the Performance of Convolutional Neural Networks via Self Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.08094","snapshot_observed_at":"2026-08-03T03:27:50.058066Z","title":"Zhao, H., Wang, H., Peng, Y ., Zhao, S., Tian, X., Chen, S., Ji, Y ., and Li, X","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:50.058066Z"},"links":{"cited_paper":"/paper/1905.08094","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:e9ac41a509dc7f5abe2ebd16112889ce47fe9e2089d86a83d55b12172d684c07","observation_id":"b091852e-94c3-471b-8806-70e2c8284acf","resolution":{"observed_at":"2026-08-03T03:27:50.058066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-03T03:27:48.347683Z","title":"Chen, Z., Ai, T., Li, Y ., Li, G., Wei, Y ., Zhou, W., Li, G., Yu, B., Chen, Z., Sun, H., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.347683Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:ccf0986748860dd1cb446b2d9ebf27bc8d6dfaa57e42247f63651e6dd5d0dc17","observation_id":"83d4c6e4-18aa-4afd-a077-c26593e135f9","resolution":{"observed_at":"2026-08-03T03:27:48.347683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.07191","last_updated":"2021-04-15T06:11:12Z","snapshot_observed_at":"2026-08-07T13:11:17.300265Z","submitted_at":"2021-03-12T10:23:47Z","title":"Are NLP Models really able to Solve Simple Math Word Problems?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.07191","snapshot_observed_at":"2026-08-03T03:27:49.270292Z","title":"Are nlp models really able to solve simple math word problems?arXiv preprint arXiv:2103.07191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:49.270292Z"},"links":{"cited_paper":"/paper/2103.07191","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:85fdd3a477db864556ac5be403b52c8d18780b7bab74f5761078ea5bb89894b7","observation_id":"9a2721a2-edda-4515-ba47-6c8667c336fd","resolution":{"observed_at":"2026-08-03T03:27:49.270292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-03T03:27:48.189325Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.189325Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:e3fda122010a9c1ec09ed87b2908f8ad193ebbca65bc7815eec2855ca5dd4a2f","observation_id":"54607f76-e570-42cd-a449-77b3b492c499","resolution":{"observed_at":"2026-08-03T03:27:48.189325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-08-03T03:27:48.790097Z","title":"Huang, Z., Xia, X., Ren, Y ., Zheng, J., Xiao, X., Xie, H., Huaqiu, L., Liang, S., Dai, Z., Zhuang, F., Li, J., Ban, Y ., and Wang, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.790097Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:641341d860d1b75184cf1b40abcb6eefd7d99fe2d74dce647675025916ed69b2","observation_id":"e52eeadc-95b1-4472-a424-8987e24dc7cf","resolution":{"observed_at":"2026-08-03T03:27:48.790097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-03T03:27:48.418725Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.418725Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:060ab80fed4a5356dfe61934cede86642321ac8975276ed0733fc7a6d07d4d77","observation_id":"1582f3b3-c8ad-4a09-a7d4-46aa0a24c73f","resolution":{"observed_at":"2026-08-03T03:27:48.418725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.22664","last_updated":"2026-05-16T16:20:52Z","snapshot_observed_at":"2026-08-06T07:44:20.276754Z","submitted_at":"2026-01-30T07:32:35Z","title":"Real-Time Aligned Reward Model beyond Semantics","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.22664","snapshot_observed_at":"2026-08-03T03:27:48.890632Z","title":"Jain, N., yeh Chiang, P., Wen, Y ., Kirchenbauer, J., Chu, H.-M., Somepalli, G., Bartoldson, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-03T03:27:48.890632Z"},"links":{"cited_paper":"/paper/2601.22664","citing_paper":"/paper/2602.08222"},"observation_digest":"sha256:1fdf27bdc0a1c6de9d7bfd0785d030e78acbdbe1639880e7306cff9da677f2ee","observation_id":"243bab27-3301-439b-92cf-da892926afa5","resolution":{"observed_at":"2026-08-03T03:27:48.890632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.08222","last_updated":"2026-06-08T02:09:05Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T09:26:17.594716Z","submitted_at":"2026-02-09T02:50:40Z","title":"Weak-Driven Learning: How Weak Agents make Strong Agents Stronger"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2602.08222."}