{"as_of":"2026-08-18T23:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96a2fc55708bbb9e9814ffdde8a98eac87a17b21eaaae615e1b1b3a1d63efd82","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:44:57.932021Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.06699/citation-record","integrity":"/paper/2505.06699/integrity","json":"/paper/2505.06699/citation-record.json","paper":"/paper/2505.06699"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.20541","last_updated":"2024-05-30T23:50:20Z","snapshot_observed_at":"2026-08-16T13:47:32.772922Z","submitted_at":"2024-05-30T23:50:20Z","title":"Perplexed by Perplexity: Perplexity-Based Data Pruning With Small Reference Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20541","snapshot_observed_at":"2026-08-15T22:44:57.795170Z","title":"L., and Paul, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.795170Z"},"links":{"cited_paper":"/paper/2405.20541","citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:fccf5a732c2a2e9a6166e0f2e01779c2aea00cecddaefd56f1df6a159b34b203","observation_id":"dac47b21-3710-4cf3-b8f6-09a70b047520","resolution":{"observed_at":"2026-08-15T22:44:57.795170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.423184Z","title":"Theory of classification: A survey of some recent advances","venue":null,"work_id":"b35877d4-98da-4a41-a9a1-335d3dd52440","year":2005},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.800309Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:c89e6db3937074eef85a0d87cecf2feb7b392e992b09fba2dbb7775283b83e5d","observation_id":"e97ab280-0d2b-4e1f-9d01-a5cb521ef208","resolution":{"observed_at":"2026-08-15T22:44:58.426500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.413496Z","title":"Conceptual 12m: Pushing web-scale image-text pre-training to recognize long-tail visual concepts","venue":null,"work_id":"f4529367-0786-40bd-a59e-3f9d9c1c4be0","year":2021},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.804286Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:b8966c4e19b79660099d4b21bfc9809110dc1b1723352881d701253b18bf96f9","observation_id":"09283d06-f554-499d-8f7d-bcdd64ba1b7e","resolution":{"observed_at":"2026-08-15T22:44:58.417042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.403973Z","title":"Net2net: Accelerating learning via knowledge transfer","venue":null,"work_id":"697fea7e-0db2-4ff0-97db-d6db05ed4e45","year":2016},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.809637Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:31fe9894d4136f3fca49628efc51efc6dfb83e480c05dadb43036fbaa57eaf32","observation_id":"ceb85770-b602-406f-8283-6133fa8b183b","resolution":{"observed_at":"2026-08-15T22:44:58.407297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.394432Z","title":"Reproducible scaling laws for contrastive language-image learning","venue":null,"work_id":"87f6d5cd-1fcb-4e90-aab5-955f19a12d67","year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.813799Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:9cfbd37824aa6c0663c8ab5438f2458979add1cb9450685612f04e8685f8d75a","observation_id":"19745f1f-0396-4037-9ca8-48f4951a53f9","resolution":{"observed_at":"2026-08-15T22:44:58.397875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1310.1531","last_updated":"2013-10-06T02:48:17Z","snapshot_observed_at":"2026-08-15T00:00:16.718715Z","submitted_at":"2013-10-06T02:48:17Z","title":"DeCAF: A Deep Convolutional Activation Feature for Generic Visual Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1310.1531","snapshot_observed_at":"2026-08-15T22:44:57.817801Z","title":"Decaf: A deep convolutional activation feature for generic visual recognition","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.817801Z"},"links":{"cited_paper":"/paper/1310.1531","citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:4b4a0133539ba4080b1896503aca6706df4b4e69fbc4247d1c3ea3b5624ab334","observation_id":"f5f8c17d-0570-4495-ba99-85cbcc5a48e2","resolution":{"observed_at":"2026-08-15T22:44:57.817801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.384317Z","title":"Stacking your transformers: A closer look at model growth for efficient LLM pre-training","venue":null,"work_id":"14c1a165-da72-4550-8b8e-d468d972e3b1","year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.823279Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:505d004787dc07fd2392e3b9b0e6614574247e28fd9cb55887d04bfea0aa66d9","observation_id":"bb4db724-2319-472c-aa2c-ae2941b46825","resolution":{"observed_at":"2026-08-15T22:44:58.388032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T22:44:57.826612Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.826612Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:b5f08b0b498db5b6211a6db7bba303f0c40e7e9e0a52f6c403c0008c26e556cf","observation_id":"0dde2620-8ebe-4dd3-8678-cc2d3cddacd2","resolution":{"observed_at":"2026-08-15T22:44:57.826612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02581","last_updated":"2017-12-14T18:50:19Z","snapshot_observed_at":"2026-08-14T21:36:06.082827Z","submitted_at":"2016-10-08T20:52:13Z","title":"Variance-based regularization with convex objectives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02581","snapshot_observed_at":"2026-08-15T22:44:57.830479Z","title":"and Namkoong, H","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.830479Z"},"links":{"cited_paper":"/paper/1610.02581","citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:adf8dc6eba033359b3788f110aeb9c2fda4f7cd433b988f4fc6b89f18e166c71","observation_id":"b590cd07-336e-49de-b29c-59a66bfea7ec","resolution":{"observed_at":"2026-08-15T22:44:57.830479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:57.835647Z","title":"C., Glynn, P","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.835647Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:9dd38ca67ffe97bfd274c2f0576eb63dbfd4a60dee93f72fadd0dd7c6e7fddc2","observation_id":"b06b6320-b339-46b3-9ed6-cd7c1097dc87","resolution":{"observed_at":"2026-08-15T22:44:57.835647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.374932Z","title":null,"venue":null,"work_id":"0a85a627-a246-4340-b57a-6f9b51b926ac","year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.839120Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:1290376895730b49197d35aff1e0d2a74ef56b1b97c79e302275c3e2d58a0280","observation_id":"64ffaa26-2dd8-42ed-8444-c8e1b87c6441","resolution":{"observed_at":"2026-08-15T22:44:58.378190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-72643-9_16","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":null,"venue":"Lecture notes in computer science","work_id":"0a866895-1a27-4500-a4a7-c180ddb95f08","year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.843182Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:592313a53a170425f2d168cfd2371be9c180d39548b61f42b8663af988485819","observation_id":"6a6b6b8a-2cf9-4f61-9c51-a74322da41ef","resolution":{"observed_at":"2026-08-15T22:44:58.002535Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.365470Z","title":null,"venue":null,"work_id":"64a55f00-8a2f-4e56-8d2c-1ebde3bcc3f7","year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.846443Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:ae73ff8a38d52fdfff824a4313de7480a2c4b59ab19edca4efd527f6ad93e279","observation_id":"9b7624bb-a71a-4e60-9fe6-a13b0542d97d","resolution":{"observed_at":"2026-08-15T22:44:58.368607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.355304Z","title":"M., Jain, A., Schmidt, L., Toshev, A","venue":null,"work_id":"9eaaabb8-90fe-4109-b611-61412d5a5f77","year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.849738Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:5b5d5f656cde950e86f6f095f40625422c20a84a4a8fd160ceec3ca0d21f343e","observation_id":"1ccfefe7-1934-4966-a451-10e9c92ef814","resolution":{"observed_at":"2026-08-15T22:44:58.358760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.345832Z","title":null,"venue":null,"work_id":"873348ad-7e56-46f8-b856-e7ac51930936","year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.853037Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:8e8f0952f82f01bdeb3422e030693df385e472750dadff65bdc3a53c39c54f31","observation_id":"2fe2998d-5089-4bb0-8076-193a26fb1b18","resolution":{"observed_at":"2026-08-15T22:44:58.349230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-15T22:44:57.856495Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.856495Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:1140b04e87d8409d979bc4e8e6ca1d3e3e8f6c1917fe7b4473f3024dc1079cfa","observation_id":"0a67973f-9b05-4733-b5bc-d494f00e6264","resolution":{"observed_at":"2026-08-15T22:44:57.856495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"hash/1160792","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.100660Z","title":"Non-smooth weakly-convex finite-sum coupled compositional optimization","venue":null,"work_id":"56aa0e06-c4b7-4206-a792-59736ecc5ab6","year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.860182Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:7e1004dad7cb506ad1a80cfe504cf29d88e2e4fcffee611034db16761943a634","observation_id":"c73ebc02-b65f-410a-9e1c-925704f109c5","resolution":{"observed_at":"2026-08-15T22:44:58.105976Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.336672Z","title":"Information theory and statistics","venue":null,"work_id":"b9863b17-28fb-4814-b8e8-0397b2335902","year":1997},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.863267Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:7d12f13174778519ff0e778c2ea88acfa98d8d4bf903cef2330cb3fb4b24b87d","observation_id":"04341935-4a7d-4be5-82f1-00a35d6f20ae","resolution":{"observed_at":"2026-08-15T22:44:58.340094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.326859Z","title":"C., and Sidford, A","venue":null,"work_id":"261f1af3-d1cb-416e-b3d0-db1d99a84e4e","year":2020},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.866783Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:5793182a5f86996bc2f08d7f0be1e69ff9bdea1f29a6dd35e3511bf026f9df69","observation_id":"152f0ad5-bc16-4a04-a712-4cdbdf9de603","resolution":{"observed_at":"2026-08-15T22:44:58.330250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:57.870200Z","title":"Not all tokens are what you need for pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.870200Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:a427b335763c369c0b99bb3e397484a73e3e31255492176bc0687d008b6d061e","observation_id":"729f5d8a-dc27-482b-a5c0-397198c0ef6e","resolution":{"observed_at":"2026-08-15T22:44:57.870200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04564","last_updated":"2023-09-08T19:34:05Z","snapshot_observed_at":"2026-08-16T15:02:10.343729Z","submitted_at":"2023-09-08T19:34:05Z","title":"When Less is More: Investigating Data Pruning for Pretraining LLMs at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04564","snapshot_observed_at":"2026-08-15T22:44:57.873639Z","title":"When less is more: Investigating data pruning for pretraining llms at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.873639Z"},"links":{"cited_paper":"/paper/2309.04564","citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:a5e1121511972d230e05975abae77f11176373e8118da45dd9ae599e24cae1ea","observation_id":"6425a83f-2d64-4e0f-9b3c-2950bb50b3a7","resolution":{"observed_at":"2026-08-15T22:44:57.873639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.311114Z","title":"M., Razzak, M","venue":null,"work_id":"445558ed-2c51-4663-b561-594fe4640b63","year":2022},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.877194Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:6a32a6c7ce9bfa9a586eb800fb6f61c36e478a6969d48d1d8d4219f0fe4475f1","observation_id":"2696bbee-3aec-42df-adac-8db90edecfb9","resolution":{"observed_at":"2026-08-15T22:44:58.314733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.299141Z","title":"Stochastic constrained DRO with a complexity independent of sample size","venue":null,"work_id":"64ad7e99-49a1-4e29-b580-53e1ff47cd09","year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.881045Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:abf4c4bd09a66481081cec47e7811fcfe4e718b88b3447f96b5d9554bda20e0c","observation_id":"46bf8174-a67c-4546-bf5b-fa4d9f07b868","resolution":{"observed_at":"2026-08-15T22:44:58.304381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.289101Z","title":"Attentional-biased stochastic gradient descent","venue":null,"work_id":"98148436-0d1d-449e-945b-e5cd174b2af2","year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.884546Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:31f3d62eebcc83f582fb1e7c71f0eb2c938ca9e9973218f07ddbc24c80b8d61a","observation_id":"99825f66-8f7b-4769-8594-6bd23183d355","resolution":{"observed_at":"2026-08-15T22:44:58.292836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.naacl-main.288","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:57.986910Z","title":"Knowledge inheritance for pre-trained language models","venue":null,"work_id":"9ad168fd-3b17-4f5c-8823-9663e18f5879","year":2022},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.887886Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:69893bc066f9f8646d644079779bb2b43c846f3668a91d7878819baf7b513d03","observation_id":"19b3cc58-e186-4822-bd74-87da356f4b6e","resolution":{"observed_at":"2026-08-15T22:44:57.991164Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.279137Z","title":"Not all semantics are created equal: Contrastive self-supervised learning with automatic temperature individualization","venue":null,"work_id":"fbbfef6e-390a-4007-b289-8e47a0a0a38a","year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.892123Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:816fe019e7f3aa68ec8eada2916246967f683701de1e4544a0c94bd181d82355","observation_id":"41f6b338-22f8-4153-8047-bb54d06c987c","resolution":{"observed_at":"2026-08-15T22:44:58.282633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:57.895427Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., Krueger, G., and Sutskever, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.895427Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:45d362df195a6b8b30c025194c646dfc6e1575645d033cc09f59253cbbb23495","observation_id":"4ed161ca-70aa-404e-9d72-e90b028a953f","resolution":{"observed_at":"2026-08-15T22:44:57.895427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-15T22:44:57.898997Z","title":"Laion-400m: Open dataset of clip-filtered 400 million image-text pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.898997Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:c9f7ab95c99f6173603bda97f786b2f703421bfcd012637ecd91877ef394e157","observation_id":"0c545544-7af8-452c-bdf5-f2c728ecb814","resolution":{"observed_at":"2026-08-15T22:44:57.898997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.263405Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"d8ce0a6b-aa6c-4b12-ae52-02656f90c1c9","year":2022},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.903504Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:104ea64d265afe7b1b5e6964ecee62e2dec016db27a26d6e5d8e1ca6170b733f","observation_id":"9925a759-d726-452e-94a1-c36ce81444ec","resolution":{"observed_at":"2026-08-15T22:44:58.267024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-1-4757-2545-2_3","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":null,"venue":"Springer series in statistics","work_id":"363d6c3d-f216-4ec3-a906-c4d5452fc09d","year":1996},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.906894Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:78760868c80644f0deb1e2ba8bed7382f4b4324de36f47f983e27deed50ca642","observation_id":"ed0bbac7-c77f-486d-bea8-ee0ec5ab3476","resolution":{"observed_at":"2026-08-15T22:44:57.979953Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.251716Z","title":null,"venue":null,"work_id":"856f60c6-7c67-430e-ab45-988663855041","year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.910788Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:d618f70f18d8b85ee1154b01459796af780998551692e62aa9d9d5c7ea485baa","observation_id":"61d5dc55-9231-47fa-b996-37e8e1b60fa3","resolution":{"observed_at":"2026-08-15T22:44:58.255996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02277","last_updated":"2025-07-20T04:14:18Z","snapshot_observed_at":"2026-08-16T14:37:43.648127Z","submitted_at":"2023-12-04T19:00:07Z","title":"A Near-Optimal Single-Loop Stochastic Algorithm for Convex Finite-Sum Coupled Compositional Optimization","version":6},"cited_work":{"arxiv_id":"2312.02277","doi":"10.48550/arxiv.2312.02277","metadata_source":"pith","pith_arxiv_id":"2312.02277","snapshot_observed_at":"2026-08-16T12:16:17.039197Z","title":"A Near-Optimal Single-Loop Stochastic Algorithm for Convex Finite-Sum Coupled Compositional Optimization","venue":"math.OC","work_id":"4658deef-8259-4bab-bdc8-acba0529f417","year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.914226Z"},"links":{"cited_paper":"/paper/2312.02277","citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:e729dbe85526c0c79f7c23bc9b123c47fb3ecf943b0c9c5d7d374ec88a0f4b0c","observation_id":"e28a1542-3d17-4212-adf9-ded7be05b743","resolution":{"observed_at":"2026-08-15T22:44:57.969456Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.241728Z","title":"T., Greengard, P., Karlinsky, L., Feris, R., Cox, D","venue":null,"work_id":"deb33287-4d23-4a5b-8d26-33f10709823f","year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.917998Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:6ae31807347468a7e31d1df7ad47f84b526b5c9b606e6c181007ebfcb4cd7bdd","observation_id":"e30dc796-e3df-4992-9fd6-960b17a427fc","resolution":{"observed_at":"2026-08-15T22:44:58.245243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01445","last_updated":"2024-10-02T17:34:06Z","snapshot_observed_at":"2026-08-16T13:38:02.865296Z","submitted_at":"2024-07-01T16:37:18Z","title":"FastCLIP: A Suite of Optimization Techniques to Accelerate CLIP Training with Limited Resources","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01445","snapshot_observed_at":"2026-08-15T22:44:57.921371Z","title":"Fastclip: A suite of optimization techniques to accelerate clip training with limited resources","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.921371Z"},"links":{"cited_paper":"/paper/2407.01445","citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:1aa13f369cc655d982bf9bcd9e1730f75438fd075f96ccc33c0d0a429168be8e","observation_id":"a1ad8742-427d-48ed-97c6-049f0e9cc753","resolution":{"observed_at":"2026-08-15T22:44:57.921371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.231208Z","title":"M., Pham, H., Dong, X., Du, N., Liu, H., Lu, Y., Liang, P","venue":null,"work_id":"9f5979c9-280e-45cb-bfba-59d61d577bab","year":2023},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.925105Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:7bce093e8418960cb46ac04ba77338a3505df2b0ffa336f0eba87656202897b0","observation_id":"62ed8068-d030-415f-a3e5-46619bbe477f","resolution":{"observed_at":"2026-08-15T22:44:58.235261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:58.220597Z","title":"Provable stochastic optimization for global contrastive learning: Small batch does not harm performance","venue":null,"work_id":"027a8df6-e04d-4a57-be18-7fb0a3289dfb","year":2022},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.928918Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:5d658f0c102a9e04ac5d9a1870bf4ee852d8305087fc631ab116460c6497bbf4","observation_id":"e0744fa5-d308-4616-ac8a-cf9529e16e11","resolution":{"observed_at":"2026-08-15T22:44:58.224295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:44:57.932021Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T22:44:57.932021Z"},"links":{"citing_paper":"/paper/2505.06699"},"observation_digest":"sha256:bc6139a662d9636fc2d171fd6e4c521ae0c936f6a5355d2e6e7323d653967b9e","observation_id":"985cacbd-ea70-48bb-8100-bdac1798d7ad","resolution":{"observed_at":"2026-08-15T22:44:57.932021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.06699","last_updated":"2025-05-17T02:26:21Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T22:33:28.375599Z","submitted_at":"2025-05-10T16:55:03Z","title":"Model Steering: Learning with a Reference Model Improves Generalization Bounds and Scaling Laws"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":5,"verified_fuzzy":16},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2505.06699."}