{"as_of":"2026-08-11T14:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf59d2239edbc47fd9b423214a1f32df8e25ee7df447840f5846d471a5e58c4d","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:14:56.145852Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:11:50.571844Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"cited_work":{"arxiv_id":"2507.06187","doi":"10.48550/arxiv.2507.06187","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.06187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains , journal =","venue":"ArXiv.org","work_id":"d926b78b-0a5d-4dd9-836f-e4340eff4c36","year":2025},"citing_paper":{"arxiv_id":"2605.05742","last_updated":"2026-05-07T06:33:25Z","snapshot_observed_at":"2026-08-10T18:26:44.733884Z","submitted_at":"2026-05-07T06:33:25Z","title":"Weak-to-Strong Generalization is Nearly Inevitable (in Linear Models)","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-08T14:53:42.342330Z"},"links":{"cited_paper":"/paper/2507.06187","citing_paper":"/paper/2605.05742"},"observation_digest":"sha256:8652e8db1fc5cc6a05b226ea79f455bac3f37ef4c09ccbf5f5119e8cf866209c","observation_id":"1c90ee3f-7a6f-4f96-93ad-8c500b62a840","resolution":{"observed_at":"2026-05-11T18:41:09.049645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"cited_work":{"arxiv_id":"2507.06187","doi":"10.48550/arxiv.2507.06187","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.06187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains , journal =","venue":"ArXiv.org","work_id":"d926b78b-0a5d-4dd9-836f-e4340eff4c36","year":2025},"citing_paper":{"arxiv_id":"2606.01000","last_updated":"2026-05-31T04:30:42Z","snapshot_observed_at":"2026-08-08T06:28:33.979360Z","submitted_at":"2026-05-31T04:30:42Z","title":"Trust Functions: Near-Lossless Weak-to-Strong Generalization by Learning When to Trust the Weak Teacher","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-28T17:35:24.108984Z"},"links":{"cited_paper":"/paper/2507.06187","citing_paper":"/paper/2606.01000"},"observation_digest":"sha256:80d45bb6d1a37e2fd869251800abeded0397876d65dcf1547920982cf1d9bff5","observation_id":"a6063add-cbbc-4559-a14d-675d7245b70a","resolution":{"observed_at":"2026-06-28T17:42:24.952269Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"cited_work":{"arxiv_id":"2507.06187","doi":"10.48550/arxiv.2507.06187","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.06187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains , journal =","venue":"ArXiv.org","work_id":"d926b78b-0a5d-4dd9-836f-e4340eff4c36","year":2025},"citing_paper":{"arxiv_id":"2606.08800","last_updated":"2026-06-07T19:39:03Z","snapshot_observed_at":"2026-08-07T03:40:11.007651Z","submitted_at":"2026-06-07T19:39:03Z","title":"Bridging Expert Knowledge and Automated Feature Engineering via Self-Evolution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T18:32:52.243662Z"},"links":{"cited_paper":"/paper/2507.06187","citing_paper":"/paper/2606.08800"},"observation_digest":"sha256:ee674a1ae1f91c98416e155edac379ac80ceb3f03c92fbf874593181147d9b57","observation_id":"fb343c3f-3a6c-4328-8c45-dac17b21d3fc","resolution":{"observed_at":"2026-07-02T22:57:26.451974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06187","snapshot_observed_at":"2026-08-10T18:11:50.571844Z","title":"The delta learning hypothesis: Preference tuning on weak data can yield strong gains","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06933","last_updated":"2026-08-07T08:06:38Z","snapshot_observed_at":"2026-08-11T14:10:43.135846Z","submitted_at":"2026-08-07T08:06:38Z","title":"Ask-E: An Environment for Calibrated Question Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T18:11:50.571844Z"},"links":{"cited_paper":"/paper/2507.06187","citing_paper":"/paper/2608.06933"},"observation_digest":"sha256:210382ed7a7fded5f732188e06c6a22bc2a81f5bed3c05f9afe5e922d119d757","observation_id":"3a3848f3-e475-4b3c-b983-4fa9d7185d29","resolution":{"observed_at":"2026-08-10T18:11:50.571844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.06187/citation-record","integrity":"/paper/2507.06187/integrity","json":"/paper/2507.06187/citation-record.json","paper":"/paper/2507.06187"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:15:00.036816Z","title":"math, code), we find pairs where Qwen 3B responds correctly but Qwen 1.5B does not (Figure A2)","venue":null,"work_id":"52453d93-1d70-415f-95c0-bdd4c1581fac","year":null},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:54.583232Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:09d9340bfb196e8689d2467292b2d96a22cc9aac9d1d5350c13254ddcb3451bb","observation_id":"6a2fb232-df05-4d9e-9e69-45f43cdef048","resolution":{"observed_at":"2026-08-06T19:15:00.118175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:59.729736Z","title":null,"venue":null,"work_id":"c3629204-9f93-49a1-b857-636bcc1e7e7b","year":null},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:54.653985Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:3410b92da6b93d7e6096c25b18e88aa3960573bb5179b6b15824fe0ddbd0906e","observation_id":"37ce8142-7b6a-4e94-b2c4-6ece943fe743","resolution":{"observed_at":"2026-08-06T19:14:59.898463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:59.444383Z","title":"Note that these deltas are not exhaustive ; we simply highlight a few here as interesting examples to motivate future work","venue":null,"work_id":"50847156-8379-450b-b128-e8250cdc2552","year":2012},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:54.710356Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:147de0ec4c31527911ecca5226eecf0875bfb297953379337d5f9eb938a3bdea","observation_id":"3b326221-4129-41d1-8ba9-2ebbf244483b","resolution":{"observed_at":"2026-08-06T19:14:59.594108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:57.180978Z","title":"First, let’s calculate the total number of cupcakes Dani brought","venue":null,"work_id":"29f308ec-6234-41be-9bce-541f7af62cba","year":2025},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:55.737202Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:26e94a1a5cb5602e25ea4490d145881cc17708fdac8e6baca5aa25ee07debb3f","observation_id":"39106cc7-a3bd-4d42-9b97-0210770f725d","resolution":{"observed_at":"2026-08-06T19:14:57.289238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:59.180382Z","title":"backbone","venue":null,"work_id":"82788c81-a73c-4e13-8c12-04dfafe14e5e","year":2025},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:54.786874Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:42c5678508608700a53a05c776c1f8c7f5e68544843c0127bb17af6df54bf2e9","observation_id":"68414a29-b03d-4a54-9af3-6a1c2df9b00e","resolution":{"observed_at":"2026-08-06T19:14:59.299278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:58.944846Z","title":"Standard tail bounds due to Laurent & Massart (2000) give that Pr x(t,i) 2 ≥ 4 √ d ≤ e−4d","venue":null,"work_id":"3b7c2cdc-209d-43fd-876b-44d1d29f4b97","year":2000},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:54.837007Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:e7581bc15bd1cd0d43101ff88036ae52a3ed02fd953fe10289ccc4ce63da5727","observation_id":"3aedc4d3-add6-44da-bb04-25439ca7954b","resolution":{"observed_at":"2026-08-06T19:14:59.052134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:58.652376Z","title":"(50) Then by Lemma F.2, for any δ2 ∈ (0, 1) we have with probability at least 1 − δ2 T ∑ i=1 ζt 2 ≤ s 2dT B ln d + 1 δ2 + 4 √ d ln d + 1 δ2","venue":null,"work_id":"143ef17d-0ef9-4a71-8d4c-4404f7dc3e13","year":2024},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:54.908482Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:ecf77d67cf4f3dc4d5e856429897f3ea15a5abe0c6015068ab887905038c3e28","observation_id":"f4f88643-13c0-43a9-ba53-dd37bcb2950f","resolution":{"observed_at":"2026-08-06T19:14:58.815388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:58.375317Z","title":"G.2 Pilot Study on U LTRA FEEDBACK -WEAK Data and filtering","venue":null,"work_id":"bbacd6b6-df1b-4647-ae5d-1fceaa1468a4","year":2023},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:55.029233Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:708dfaad3ccc6a095968f9607cd43b0e7d583427c8243c8ea16842c006a0d16b","observation_id":"b8821b52-fa1b-4972-a25e-4c6b5eb17695","resolution":{"observed_at":"2026-08-06T19:14:58.486504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:57.884819Z","title":null,"venue":null,"work_id":"71ae08f0-1dca-4bdb-b987-43b4f3b7f3a3","year":null},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:55.329403Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:bbccf7133c276866166471fbcec75eb5c08693b235b2550e284641f7b3df5afa","observation_id":"18283c0c-bbdf-44a7-b1a1-7765a011e8d9","resolution":{"observed_at":"2026-08-06T19:14:57.982284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:57.657251Z","title":null,"venue":null,"work_id":"b2689bb1-7d81-42e4-9b33-13aff0a4db86","year":null},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:55.463643Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:7dd3058b35978f0956cfa6116f26e503c9da7cb497e0ecbfdb54723824e68124","observation_id":"d60d945e-9dd0-48f2-ac82-7e3c2e52bddf","resolution":{"observed_at":"2026-08-06T19:14:57.780147Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:57.405014Z","title":null,"venue":null,"work_id":"15ace9f6-594f-43de-aa49-37184486bd5b","year":null},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:55.585102Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:ec69c07617edcbfd8580c2ff4619d49256173f9b190685a67cdc0bf515b09b5e","observation_id":"bc47611d-7ea8-4464-863e-124de54ed609","resolution":{"observed_at":"2026-08-06T19:14:57.517980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:56.922584Z","title":"This migration involved groups moving into Europe, the Middle East, and eventually Asia","venue":null,"work_id":"95a91711-fc7b-4a9f-b3d8-b5ab0e454059","year":null},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:55.828798Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:bf4899ccf9c6cbd8c34ccebf50b0499b325456e7475904d45ef246a8891b96c0","observation_id":"92d495d9-db1c-4a6d-b78d-07b78d943f39","resolution":{"observed_at":"2026-08-06T19:14:57.041833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:56.667956Z","title":null,"venue":null,"work_id":"320e2704-8a11-44a8-b04c-3ea753fd220a","year":null},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:55.942152Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:b77313bd6c171c4533a8458b8055029e44781005d01c079b965d481c40e8d7b3","observation_id":"159c9b34-aedb-4cfd-b613-7a79fd06ad3c","resolution":{"observed_at":"2026-08-06T19:14:56.778819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:56.435255Z","title":null,"venue":null,"work_id":"abdd6d94-4ce2-46df-a4fe-039698800500","year":null},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:56.029143Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:8e55db719d64e18146cb5065a0741f3c0248478da56bb24e13553c46923bb06e","observation_id":"ab3a4335-4dac-473d-b99a-e4b0a4c32d7e","resolution":{"observed_at":"2026-08-06T19:14:56.527202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:56.237005Z","title":null,"venue":null,"work_id":"21336292-904a-45bb-9605-59e0f9e119b8","year":2025},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:56.145852Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:2f0a4f7c668dd6c397d50128cf2bdb898f861bee3b3033990c09de4ec9663326","observation_id":"4dc56044-df36-41e4-b428-c3fc78584584","resolution":{"observed_at":"2026-08-06T19:14:56.314766Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:58.092673Z","title":"Include bolded sections in your re- sponse","venue":null,"work_id":"a884d895-6bb3-4416-a34c-c4435a8e20dc","year":2023},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":1100,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:55.143069Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:dd9b7b5b75143c1a2dec5ca5b4a29591cf89ba5e24ba6e9e9fcb75cd20e9420a","observation_id":"d3040673-83c2-4a54-95ea-9bcc78591980","resolution":{"observed_at":"2026-08-06T19:14:58.259874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:15:00.256153Z","title":"weak responses","venue":null,"work_id":"6561f331-6ca0-43f8-9763-c3aefbd21a62","year":2020},"citing_paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:54.511833Z"},"links":{"citing_paper":"/paper/2507.06187"},"observation_digest":"sha256:581b6911fc5e0157e571343e828d3d5276ffcaced70eb5246bbefe053bdf1bea","observation_id":"b36142f3-9f9c-4f5f-a30c-e2bdecdeb233","resolution":{"observed_at":"2026-08-06T19:15:00.366527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06187","last_updated":"2025-07-08T17:14:44Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T20:33:47.251399Z","submitted_at":"2025-07-08T17:14:44Z","title":"The Delta Learning Hypothesis: Preference Tuning on Weak Data can Yield Strong Gains"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 4 inbound Pith citation observations for arXiv:2507.06187."}