{"as_of":"2026-08-08T01:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c332c81cb62b63e00c6dc7d30cc281c3ffc0515273ffb95b12687724e4fd0557","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:23:18.667504Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.22042/citation-record","integrity":"/paper/2505.22042/integrity","json":"/paper/2505.22042/citation-record.json","paper":"/paper/2505.22042"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:27.697798Z","title":"Critical learning periods in deep networks","venue":null,"work_id":"3e1c4e07-6997-473a-b3db-d08817b1d70f","year":2018},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:05.998136Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:f8e583995bc6c4c156f43e3baa238314192167309baef49e67ec71d1e6828167","observation_id":"b5fecbbc-6536-48fb-8af4-81d47bd2ddcc","resolution":{"observed_at":"2026-08-07T13:23:27.854004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:27.472855Z","title":"If influence functions are the answer, then what is the question?Advances in Neural Information Processing Systems, 35:17953–17967, 2022","venue":null,"work_id":"0576823a-569f-42f6-bd8e-8323cbaef77a","year":2022},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:07.321744Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:0b8fb77df446671e3362fa7d0a2036d0803af75dff436a337817c9dd02a6db2d","observation_id":"d26aad62-f06c-46d4-aef9-12336ab779eb","resolution":{"observed_at":"2026-08-07T13:23:27.590779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:07.456970Z","title":"Influence functions in deep learning are fragile","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:07.456970Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:08e974d2ff523d423bc56055d852e0d5fa50fb1383f3f9e5dffc0dc356e67059","observation_id":"41cdcd03-202b-4257-aa9d-82f6aa945fe6","resolution":{"observed_at":"2026-08-07T13:23:07.456970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:07.624475Z","title":"Curriculum learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:07.624475Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:e6551fc6e9b5ed6e69acd8070a92eb73701c0d4f346aa75118c7e55667702084","observation_id":"3d5a4f78-642e-42c7-905e-28bc1f6e1426","resolution":{"observed_at":"2026-08-07T13:23:07.624475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:08.111514Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:08.111514Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:d7367813ce4a743d9cb75649179d2b5670a4992107026e071a8d2cd4a275e715","observation_id":"ce364a44-5cbb-47ff-8f30-8b05215ac3d3","resolution":{"observed_at":"2026-08-07T13:23:08.111514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:09.938308Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:09.938308Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:1b42ce4e8d41899b3746e08da3b062f295702115af15c31edda06833e0a24179","observation_id":"6b16de16-af20-430a-818d-ef94fa86b9e7","resolution":{"observed_at":"2026-08-07T13:23:09.938308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:27.199155Z","title":"Generalization potential of large language models.Neural Computing and Applications, 37(4):1973–1997, 2025","venue":null,"work_id":"d63ac64d-12f3-4b65-9da1-bf753c39809f","year":1973},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.049158Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:1feb5b8cdedd63093c297d95200d9a4a8f1e67ca8658893187093855a7ece64d","observation_id":"7ceafe11-c3ce-43b2-80ac-5d28c3e96aa4","resolution":{"observed_at":"2026-08-07T13:23:27.323026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02170","last_updated":"2021-08-04T16:53:43Z","snapshot_observed_at":"2026-07-06T11:35:35.934125Z","submitted_at":"2021-08-04T16:53:43Z","title":"Curriculum learning for language modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.02170","snapshot_observed_at":"2026-08-07T13:23:10.190869Z","title":"Curriculum learning for language modeling.arXiv preprint arXiv:2108.02170, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.190869Z"},"links":{"cited_paper":"/paper/2108.02170","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:37de8f870b947b3320ebd390e942abdac573a4b7ccd1627978930f86b3a37bb0","observation_id":"3a911a51-a6fb-4825-9d11-ea30846d15a4","resolution":{"observed_at":"2026-08-07T13:23:10.190869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:26.956963Z","title":"Fast and accurate network embeddings via very sparse random projection","venue":null,"work_id":"9ce6a11b-dec9-4d85-8acf-4b8c8b3d0688","year":2019},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.300336Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:edeb7ffd2b121d8881496f826e13edc58382bffcf1212010c26e54c3ba030c7c","observation_id":"65a85616-198e-4115-9d96-7a3f8a0de651","resolution":{"observed_at":"2026-08-07T13:23:27.032684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:10.427714Z","title":"Zoo: Zeroth order optimization based black-box attacks to deep neural networks without training substitute models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.427714Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:83dd8179b830d2251bf0255ad4af9a502c9cc6766660882de6e86ed9e3c4edde","observation_id":"3ea32065-3dce-437e-b626-466dff6bfa4b","resolution":{"observed_at":"2026-08-07T13:23:10.427714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:10.578529Z","title":"Zo- adamm: Zeroth-order adaptive momentum method for black-box optimization.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.578529Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:1a48ddd2bc18ca255650d26e729239ba956a6ec0997ecb5f230cf5c9f870320a","observation_id":"b7e36e61-d0ea-4ba0-b274-bc5f6b07a740","resolution":{"observed_at":"2026-08-07T13:23:10.578529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:26.678630Z","title":"Optimal rates for zero-order convex optimization: The power of two function evaluations.IEEE Transactions on Information Theory, 61(5):2788–2806, 2015","venue":null,"work_id":"37757ff8-db24-4f77-b732-b6599c5aeec6","year":2015},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.731449Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:fa60d7667f984275479a051101269f61508a12f55516d684bdf88604b562f8c4","observation_id":"b35db9f2-732b-401c-b82e-7f63f8bbe150","resolution":{"observed_at":"2026-08-07T13:23:26.760349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:10.901140Z","title":"What neural networks memorize and why: Discovering the long tail via influence estimation.Advances in Neural Information Processing Systems, 33:2881–2891, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.901140Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:2dc407ddb49de60a53ad1cbaedf605419a3b3882ece7ff5294b5a0b8bfda2872","observation_id":"9d1b8b91-3d8a-4747-a5d0-fd25280f5209","resolution":{"observed_at":"2026-08-07T13:23:10.901140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"cs/0408007","last_updated":"2004-08-02T21:24:41Z","snapshot_observed_at":"2026-07-07T03:05:55.751870Z","submitted_at":"2004-08-02T21:24:41Z","title":"Online convex optimization in the bandit setting: gradient descent without a gradient","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"cs/0408007","snapshot_observed_at":"2026-08-07T13:23:11.090686Z","title":"Online convex opti- mization in the bandit setting: gradient descent without a gradient.arXiv preprint cs/0408007, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.090686Z"},"links":{"cited_paper":"/paper/cs/0408007","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:77c81a423712053d9de92f0bec3f260641377652476a4010698cbf892b714978","observation_id":"4a54bc48-f247-44ca-973f-7d20c8f2c31d","resolution":{"observed_at":"2026-08-07T13:23:11.090686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10365","last_updated":"2020-02-24T16:51:01Z","snapshot_observed_at":"2026-08-06T07:50:58.718464Z","submitted_at":"2020-02-24T16:51:01Z","title":"The Early Phase of Neural Network Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.10365","snapshot_observed_at":"2026-08-07T13:23:11.231158Z","title":"The early phase of neural network training.arXiv preprint arXiv:2002.10365, 2020","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.231158Z"},"links":{"cited_paper":"/paper/2002.10365","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:dfc06de37a6e78e6036f388481308ab81917cd03664f1b96cf9e605c6b7bcfb2","observation_id":"83e75901-47d7-429a-872e-8738f27d44ad","resolution":{"observed_at":"2026-08-07T13:23:11.231158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:11.429762Z","title":"Stochastic first-and zeroth-order methods for nonconvex stochastic programming.SIAM journal on optimization, 23(4):2341–2368, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.429762Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:6c792ffd57bd33b05a031d785b041802966f4582cc1f66cc263a46339ba47e43","observation_id":"68f04328-ad75-4ee9-bc91-282f007ba9fa","resolution":{"observed_at":"2026-08-07T13:23:11.429762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:26.361363Z","title":"Deep curriculum learning optimization.SN Computer Science, 1(5):245, 2020","venue":null,"work_id":"3b0a08f9-15f8-4e66-9dc0-7299b81cbb16","year":2020},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.568345Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:383bfdbc61a5f4f9a048e71d96a81c49e6d9fcf8432a0be3273e250ec08654b7","observation_id":"e4a4395b-1bf9-4809-8606-eaf34cd865e1","resolution":{"observed_at":"2026-08-07T13:23:26.527182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.06317","last_updated":"2020-05-18T20:08:57Z","snapshot_observed_at":"2026-07-06T08:37:09.028140Z","submitted_at":"2019-11-14T18:58:13Z","title":"Gradientless Descent: High-Dimensional Zeroth-Order Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.06317","snapshot_observed_at":"2026-08-07T13:23:11.682381Z","title":"Gradientless descent: High-dimensional zeroth-order optimization.arXiv preprint arXiv:1911.06317, 2019","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.682381Z"},"links":{"cited_paper":"/paper/1911.06317","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:0d0f473d320b9ba465f0e453cb66417161292c2333c2ccc801b3710f816c007a","observation_id":"9b9c7e27-90a6-40ea-87d6-e79f128ed481","resolution":{"observed_at":"2026-08-07T13:23:11.682381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:26.132615Z","title":"Training dynamics for text summarization models","venue":null,"work_id":"78698481-5175-4548-a94d-427148aa0475","year":2022},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.844546Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:ad4903d3352782479b9faeb48d7a3d40990a55c94db592bd5f626a86211c0978","observation_id":"e1f668a4-cc90-4f0e-94ec-0c0932701506","resolution":{"observed_at":"2026-08-07T13:23:26.226396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:11.956765Z","title":"Au- tomated curriculum learning for neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.956765Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:46dae05f5f78f3583606bfe17be213a2a0d1d83212fbe689a6ce90779dcfec9a","observation_id":"6498feb2-d83f-460c-a560-aed3f0f60cdf","resolution":{"observed_at":"2026-08-07T13:23:11.956765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:25.897422Z","title":"Curriculum learning for facial expression recognition","venue":null,"work_id":"666bf2a0-7e06-4810-a41c-c45f6cd42947","year":2017},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.103559Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:c104fac761aa7660d11b3fec60b8d7e3025b61311a4ba26bd75acd4246293e11","observation_id":"126c34b4-4334-4a28-b373-cb3e8d006bc6","resolution":{"observed_at":"2026-08-07T13:23:26.001826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:25.661478Z","title":"Fastif: Scalable influence functions for efficient model interpretation and debugging","venue":null,"work_id":"5e028384-1492-4290-ab16-4271477493c6","year":2021},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.222873Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:e71ac289c9b24471a5fb45f557fb8db271850224c2b7edf554bc9ff3337508dc","observation_id":"f6be3e32-da86-4f54-9fb5-804c1bb7ef77","resolution":{"observed_at":"2026-08-07T13:23:25.784738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:12.395835Z","title":"On the power of curriculum learning in training deep networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.395835Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:6666f447d400d8ba653220f13db7382416842b4b29a3214917381045bfcbf3b7","observation_id":"26a05e52-2067-4e15-86b8-b067ffdf3770","resolution":{"observed_at":"2026-08-07T13:23:12.395835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06105","last_updated":"2024-05-09T21:15:49Z","snapshot_observed_at":"2026-07-06T18:12:22.193554Z","submitted_at":"2024-05-09T21:15:49Z","title":"Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06105","snapshot_observed_at":"2026-08-07T13:23:12.498757Z","title":"Can perplexity reflect large language model’s ability in long text understanding?ArXiv, abs/2405.06105, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.498757Z"},"links":{"cited_paper":"/paper/2405.06105","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:3746a6e41256fdf8d88c93efbe5050aff27909d3e7d34027724d39823c714bd1","observation_id":"2fbec718-33e2-4357-a576-971245cd44d9","resolution":{"observed_at":"2026-08-07T13:23:12.498757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:25.501307Z","title":"A review on genetic algorithm: past, present, and future.Multimedia Tools and Applications, 80:8091 – 8126, 2020","venue":null,"work_id":"8662494b-fa7f-44ec-b668-19ad35de0165","year":2020},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.620294Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:572c47f1796e118bf9632502c7f91d4219b5390c2875657fda5497abb1c79f1c","observation_id":"4d44bc17-1c27-4994-965d-74cd1739f458","resolution":{"observed_at":"2026-08-07T13:23:25.577051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07490","last_updated":"2024-05-13T06:09:10Z","snapshot_observed_at":"2026-07-06T18:13:20.536375Z","submitted_at":"2024-05-13T06:09:10Z","title":"Strategic Data Ordering: Enhancing Large Language Model Performance through Curriculum Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07490","snapshot_observed_at":"2026-08-07T13:23:12.811259Z","title":"Strategic data ordering: Enhancing large language model performance through curriculum learning.ArXiv, abs/2405.07490, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.811259Z"},"links":{"cited_paper":"/paper/2405.07490","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:cad4fb95ce0091eb2ab952a17af2410c89ade98ba928882d5350ba0674564a6c","observation_id":"c9a885ee-f18b-43a1-8493-aa0417a4fe3d","resolution":{"observed_at":"2026-08-07T13:23:12.811259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:12.923995Z","title":"Understanding black-box predictions via influence functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.923995Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:73994cd48b75254734c4581f712b4828cb2230445556f63eb64d7545c2017684","observation_id":"4e5fe4cb-c923-4e54-9811-57ca8ff20a71","resolution":{"observed_at":"2026-08-07T13:23:12.923995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:13.077097Z","title":"On the accuracy of influence functions for measuring group effects.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:13.077097Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:201385343ea40ea9f84ae7155482af3e037f65dab63df193a18fa74e5e4dec9c","observation_id":"6e164834-fbfe-40a6-8c43-0fe9ff725584","resolution":{"observed_at":"2026-08-07T13:23:13.077097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:25.240350Z","title":"Crossover operators in genetic algorithms: A review","venue":null,"work_id":"d2fc7350-7e72-4b32-8458-2c539eed5b63","year":2017},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:13.232691Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:327a99aef0532ddaac9403901401472bf607b4bb554fc02eff88248a7377931c","observation_id":"dd8ec27b-7919-4664-8cbf-eae1693b696b","resolution":{"observed_at":"2026-08-07T13:23:25.353506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:25.006279Z","title":"Causal estimation of memorisation profiles","venue":null,"work_id":"aa0bda89-1a66-4bd6-a5ad-700c7149e2fb","year":2024},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:13.363349Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:38f9e37e7d382166415d5556e817b6981df3262049b1f6a7e3f46d81b5eb0cc9","observation_id":"846c5766-49cc-48c4-a8ad-4366e8c8ef7b","resolution":{"observed_at":"2026-08-07T13:23:25.127205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:24.751472Z","title":"Environment curriculum generation via large language models","venue":null,"work_id":"53a83fc4-dcde-4384-9284-e8c93acb852c","year":2024},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:13.511145Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:d856236b919e811e0ac2b83afa5d8322a0accfad2dfe870039f9849b45ae262d","observation_id":"d137a686-8636-4c19-b224-cc09806081a3","resolution":{"observed_at":"2026-08-07T13:23:24.848975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:24.486677Z","title":"Token-wise influential training data retrieval for large language models","venue":null,"work_id":"ab7a5366-63a2-4831-a911-f39ffe421ac2","year":2024},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:13.671849Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:65fe3b550d02cd77c30514bc6b9d970c308335cab41fb5855dcc4dd57b5d7aba","observation_id":"59e4e7c5-bd68-4892-a71f-311d38da6cb5","resolution":{"observed_at":"2026-08-07T13:23:24.604525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:24.209030Z","title":"A primer on zeroth-order optimization in signal processing and machine learning: Principals, recent advances, and applications.IEEE Signal Processing Magazine, 37(5):43–54, 2020","venue":null,"work_id":"6c31ab11-2f25-4e57-af2e-8ecd9951aade","year":2020},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:13.861862Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:ab366f19133f1e94410e69d5ad83170a5be4db88661071b81d5d847fca71ccf3","observation_id":"460cf437-ee3f-4936-84ec-147185782950","resolution":{"observed_at":"2026-08-07T13:23:24.327159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:23.931187Z","title":"Probing across time: What does roberta know and when? InFindings of the Association for Computational Linguistics: EMNLP 2021, pages 820–842, 2021","venue":null,"work_id":"62b82661-3264-4bdd-9ec2-7b0b83fd27e5","year":2021},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:14.041625Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:160de4a0a0da95b8e4d9d943e22d4210a09492d28987018d5dd260436d5c4304","observation_id":"e77bd0ab-bc73-44af-ae00-c5c68e644ccf","resolution":{"observed_at":"2026-08-07T13:23:24.045803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:14.195735Z","title":"Fine-tuning language models with just forward passes.Advances in Neural Information Processing Systems, 36:53038–53075, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:14.195735Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:6ef9e9c8cab681c261a387c506a1d22258373a2e84a1d9cde3429a52fc9044ae","observation_id":"8bbeade3-4b3b-42bc-9b4e-dfb1ea28190b","resolution":{"observed_at":"2026-08-07T13:23:14.195735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:14.372969Z","title":"Teacher–student curriculum learning.IEEE transactions on neural networks and learning systems, 31(9):3732–3740, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:14.372969Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:b6cbc4f309cc7c2acc3a7c955ae8d3c97159eb68f826562aa3a4bb3bfc81a90b","observation_id":"d5d23a0a-8acc-4d0b-b449-7367958fd5c5","resolution":{"observed_at":"2026-08-07T13:23:14.372969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:23.762872Z","title":"Scalable language modeling: Wikitext-103 on a single gpu in 12 hours.Proceedings of the SYSML, 18, 2018","venue":null,"work_id":"36ba51af-569d-46f1-a001-891ee5a1c1d5","year":2018},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:14.485168Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:75e57b1818138d5dbc27b606f6782c57f0580f025796e7685fa0a889c4be3438","observation_id":"08cd35ae-6246-49e0-af74-9df10d2341d6","resolution":{"observed_at":"2026-08-07T13:23:23.839571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.08240","last_updated":"2018-03-22T06:25:47Z","snapshot_observed_at":"2026-07-06T06:29:37.728867Z","submitted_at":"2018-03-22T06:25:47Z","title":"An Analysis of Neural Language Modeling at Multiple Scales","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08240","snapshot_observed_at":"2026-08-07T13:23:14.622946Z","title":"An analysis of neural language modeling at multiple scales.arXiv preprint arXiv:1803.08240, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:14.622946Z"},"links":{"cited_paper":"/paper/1803.08240","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:511b6b2c75610828b69c1ed12c6166c08d42d3ec15304e6161dbdf31154c8422","observation_id":"f1238d16-26ea-4a01-b43f-78f07d0ffbfa","resolution":{"observed_at":"2026-08-07T13:23:14.622946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10194","last_updated":"2024-07-14T13:32:24Z","snapshot_observed_at":"2026-08-05T05:50:30.509128Z","submitted_at":"2024-07-14T13:32:24Z","title":"Curriculum Learning for Small Code Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10194","snapshot_observed_at":"2026-08-07T13:23:14.725958Z","title":"Curriculum learning for small code language models.arXiv preprint arXiv:2407.10194, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:14.725958Z"},"links":{"cited_paper":"/paper/2407.10194","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:48a7162fbcdaee6f082dab9716730e5a2b68079c7d96b0ab4c11e055697d0767","observation_id":"d9f3424a-a424-4d21-a1f5-d6048784c6f9","resolution":{"observed_at":"2026-08-07T13:23:14.725958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:14.833521Z","title":"Random gradient-free minimization of convex functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:14.833521Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:850466564b90dd07919e18e8a8f49503cbd4d077bc92cf3e83b01e761eebf759","observation_id":"c7df00cb-89fc-4734-9975-d3f6fc2a2fe4","resolution":{"observed_at":"2026-08-07T13:23:14.833521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19363","last_updated":"2025-04-08T03:21:10Z","snapshot_observed_at":"2026-08-07T17:45:25.221332Z","submitted_at":"2025-02-26T18:01:19Z","title":"DataMan: Data Manager for Pre-training Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19363","snapshot_observed_at":"2026-08-07T13:23:14.940039Z","title":"Dataman: Data manager for pre-training large language models.arXiv preprint arXiv:2502.19363, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:14.940039Z"},"links":{"cited_paper":"/paper/2502.19363","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:b099e5557c88d5a80e5db075c34e7ebbe1afe22dc075e08eb478d7a0e9943224","observation_id":"35f86e50-842b-444e-9bbd-641bac811a11","resolution":{"observed_at":"2026-08-07T13:23:14.940039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:15.012756Z","title":"Svcca: Singular vector canonical correlation analysis for deep learning dynamics and interpretability.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:15.012756Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:7c1a398646c1fb29e72dd129be7a92dcbe313ce549569a060a727d8cbce35e22","observation_id":"4b5cc26a-8d58-4157-a1ef-f8828d95154c","resolution":{"observed_at":"2026-08-07T13:23:15.012756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:23.493640Z","title":"Sutherland","venue":null,"work_id":"2eee1b53-228c-4365-847e-6383c907bd4d","year":2025},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:15.112624Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:3f370764b1978468c3fe2129e861ab3f5c7fd3d55194db62ab3143e3db8a7f70","observation_id":"ad107f75-f08b-4b06-be47-49784949fc7f","resolution":{"observed_at":"2026-08-07T13:23:23.629575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:23.274035Z","title":"Training dynamics of neural language models","venue":null,"work_id":"9a45f249-5e74-4831-96a9-c6754bd9b527","year":2021},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:15.177903Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:6a96525e945bab4f38602acac5d524617e4638a275324f0f10c6dff470096932","observation_id":"ea670bfb-8701-44a5-84e4-20ec413fd288","resolution":{"observed_at":"2026-08-07T13:23:23.388820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00225","last_updated":"2019-04-03T14:45:07Z","snapshot_observed_at":"2026-07-06T07:11:57.756712Z","submitted_at":"2018-11-01T04:51:20Z","title":"Understanding Learning Dynamics Of Language Models with SVCCA","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00225","snapshot_observed_at":"2026-08-07T13:23:15.296574Z","title":"Understanding learning dynamics of language models with svcca.arXiv preprint arXiv:1811.00225, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:15.296574Z"},"links":{"cited_paper":"/paper/1811.00225","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:f5252994f0d3ceed5f13f16cf11de1f08c11a24c4db50c093fdc40c31948d2ac","observation_id":"8003afbf-2c4d-4590-9484-f88e7b687de5","resolution":{"observed_at":"2026-08-07T13:23:15.296574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:23.038180Z","title":"On the dynamics of gender learning in speech translation","venue":null,"work_id":"5dba8232-02f9-4db2-bfb0-9bafe2162472","year":2022},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:15.454857Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:c465aed5042543843ba26957971fe353fae7982e3e9c2405e749cf19f13cc47c","observation_id":"3f6b1bc6-9847-438b-a5b7-1ad75e82f45d","resolution":{"observed_at":"2026-08-07T13:23:23.165511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:22.848980Z","title":"Emergent structures and training dynamics in large language models","venue":null,"work_id":"9f2ad06b-e856-4d1a-bde8-038d28ab48c3","year":2022},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:15.587239Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:b226a742486bd81ee1c3704716a5f0fbc765dabf0a94241f2ee908de067dcce4","observation_id":"c5af48f2-4de5-4032-bd3f-095700cf2bc9","resolution":{"observed_at":"2026-08-07T13:23:22.919220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:15.678662Z","title":"Memorization without overfitting: Analyzing the training dynamics of large language models.Advances in Neural Information Processing Systems, 35:38274–38290, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:15.678662Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:4abfe043b7ac0c6570211bd549906e006bde79b0ee5a7e2c5bfaafc3fba378f6","observation_id":"5ac3aece-b90d-4d0d-aa89-2bccabba99a5","resolution":{"observed_at":"2026-08-07T13:23:15.678662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T13:23:15.823421Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:15.823421Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:d734c163cabb9144b42d2a10c274a79e1a3262951746836e1349487ab7f40f8a","observation_id":"48e07c9d-f4db-4191-a370-c7460837f471","resolution":{"observed_at":"2026-08-07T13:23:15.823421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:22.579057Z","title":"How hard can it be? estimating the difficulty of visual search in an image","venue":null,"work_id":"3cb00348-c0d8-4618-aaf0-034fb4e3e4b3","year":2016},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:15.957620Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:f99d2c08ace807d237ff43e312c5fcc77c52e39205353bd61c5b62b83c01322d","observation_id":"4270f250-3ed5-416a-94bc-10c13b2f22e5","resolution":{"observed_at":"2026-08-07T13:23:22.722298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:22.434595Z","title":"The johnson-lindenstrauss transform: an empirical study","venue":null,"work_id":"8d353d61-2fea-4653-a061-494c29915108","year":2011},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:16.043129Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:2370a286bdfe93b7a8ddbcdb5052c9830a160cfdeb50aa77b64a9008dc1668e4","observation_id":"5b52c8d8-e827-4b54-8f9f-5a087bf3e8f0","resolution":{"observed_at":"2026-08-07T13:23:22.482784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:22.320086Z","title":"Curriculum learning for multimedia in the era of large language models","venue":null,"work_id":"d9c99e0a-6c72-48a9-8ed1-f274fde7dd1d","year":2024},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:16.147108Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:1f7927751b7113db59dfb0ae8aa871963ef822c1314f3f540ec69e0f5a5ad47b","observation_id":"d812d4e7-111b-4141-97d7-15be0e38031a","resolution":{"observed_at":"2026-08-07T13:23:22.371733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:22.182649Z","title":"Stochastic zeroth-order optimization in high dimensions","venue":null,"work_id":"8ec093a3-54be-4bf2-83aa-b27045d64775","year":2018},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:16.277037Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:e90d86a22207f6ce2dddc0d3e09f696fcde8f936848e96d0771db30ae8ab77a2","observation_id":"366cca89-e530-4276-b2dc-cdd981104087","resolution":{"observed_at":"2026-08-07T13:23:22.261567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:21.935369Z","title":"Curriculum learning by transfer learning: Theory and experiments with deep networks","venue":null,"work_id":"87b44d56-6033-42da-96b6-cecd062a36f2","year":2018},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:16.387154Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:958463e6d02f6c2fa2c76fb3ab1d13fa01144166650136fb8806de0bdea86b57","observation_id":"6ced60e6-1c47-4172-a105-01fcbdf031ad","resolution":{"observed_at":"2026-08-07T13:23:22.056780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:21.688310Z","title":"Curriculum learning for natural language understanding","venue":null,"work_id":"fbd15132-1f81-4d08-90a9-834d3ee982af","year":2020},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:16.512735Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:9ffbae8e3b97861aad01f4691e3b954265b00b8f30cc5973862345d05ec1f373","observation_id":"1da6ce44-fc90-471b-ad73-730a07a88737","resolution":{"observed_at":"2026-08-07T13:23:21.827040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:21.523762Z","title":"To repeat or not to repeat: Insights from scaling llm under token-crisis, 2023","venue":null,"work_id":"d2606fc7-9944-456a-8b20-ee1b19db6c4d","year":2023},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:16.627033Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:bbad5c00963a5603176394603707ec4751f3caa7821d6b0d2dce38499ff7f01f","observation_id":"6c20a177-9433-4e34-b74f-ac2a732b7db4","resolution":{"observed_at":"2026-08-07T13:23:21.623817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:21.310452Z","title":"Dpzero: dimension- independent and differentially private zeroth-order optimization","venue":null,"work_id":"b274b2f7-0013-4dda-badb-42f630fa4572","year":2023},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:16.749396Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:405cbe47314be401f89d5601ec243964a3a997502b73729417b42a1c1a64200c","observation_id":"d7bb3c70-3c84-4182-9ab7-df105a1a1ed3","resolution":{"observed_at":"2026-08-07T13:23:21.395411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00739","last_updated":"2018-11-02T05:05:26Z","snapshot_observed_at":"2026-07-06T07:12:12.754792Z","submitted_at":"2018-11-02T05:05:26Z","title":"An Empirical Exploration of Curriculum Learning for Neural Machine Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00739","snapshot_observed_at":"2026-08-07T13:23:16.883475Z","title":"An empirical exploration of curriculum learning for neural machine translation.arXiv preprint arXiv:1811.00739, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:16.883475Z"},"links":{"cited_paper":"/paper/1811.00739","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:17f1c5e0497e1a5a56ada3a45c9f4cb781fed8b61f84ce50aff8b7be3d0d8800","observation_id":"153fc756-b1ab-4a6f-a64e-04972164b57d","resolution":{"observed_at":"2026-08-07T13:23:16.883475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05551","last_updated":"2025-05-31T14:08:15Z","snapshot_observed_at":"2026-08-03T17:10:48.008648Z","submitted_at":"2025-02-08T12:46:33Z","title":"FRAME: Boosting LLMs with A Four-Quadrant Multi-Stage Pretraining Strategy","version":4},"cited_work":{"arxiv_id":"2502.05551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05551","snapshot_observed_at":"2026-08-07T13:23:19.313687Z","title":"FRAME: Boosting LLMs with A Four-Quadrant Multi-Stage Pretraining Strategy","venue":"cs.CL","work_id":"a1fa5fbf-8c87-4bc0-83f3-26d70d249014","year":2025},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:17.014654Z"},"links":{"cited_paper":"/paper/2502.05551","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:9e3a64862aa59fcfa335235ea045a7e441c21896e86da590d059878bf7a2e968","observation_id":"26c1772e-475e-4b85-974d-9a4acc841ab0","resolution":{"observed_at":"2026-08-07T13:23:19.417173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13126","last_updated":"2025-02-17T11:44:35Z","snapshot_observed_at":"2026-08-07T16:20:53.820171Z","submitted_at":"2025-01-21T13:12:13Z","title":"Preference Curriculum: LLMs Should Always Be Pretrained on Their Preferred Data","version":2},"cited_work":{"arxiv_id":"2501.13126","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13126","snapshot_observed_at":"2026-08-07T13:23:19.110659Z","title":"Preference Curriculum: LLMs Should Always Be Pretrained on Their Preferred Data","venue":"cs.CL","work_id":"e14729f1-c490-4db1-813e-50e38e2ce676","year":2025},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:17.148559Z"},"links":{"cited_paper":"/paper/2501.13126","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:cfa0179ad54e395c5b58dd1c44f35513083e74536b4494709651b0d10144d1e3","observation_id":"03ff89cc-0680-49ab-9f54-8f90daec134b","resolution":{"observed_at":"2026-08-07T13:23:19.216553Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11592","last_updated":"2024-05-28T03:27:06Z","snapshot_observed_at":"2026-07-06T17:31:50.029722Z","submitted_at":"2024-02-18T14:08:48Z","title":"Revisiting Zeroth-Order Optimization for Memory-Efficient LLM Fine-Tuning: A Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11592","snapshot_observed_at":"2026-08-07T13:23:17.231694Z","title":"Revisiting zeroth-order optimization for memory-efficient llm fine-tuning: A benchmark.arXiv preprint arXiv:2402.11592, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:17.231694Z"},"links":{"cited_paper":"/paper/2402.11592","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:95f28624a1474b633ca43551fdcc2a4e52b0b987c3a82dd628541eb8e7ccce86","observation_id":"026661ac-7dfe-46ca-8d12-6987f3b3b368","resolution":{"observed_at":"2026-08-07T13:23:17.231694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:21.127058Z","title":"Billion-scale network embedding with iterative random projection","venue":null,"work_id":"e2309e48-10df-46e1-a381-4f99aa222e92","year":2018},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:17.323638Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:6928e9fa0d31fbdd6dd98b53baaa4743705dd6610db9d60df519ec6a875f6c26","observation_id":"40a189f7-9f1e-4d10-8f2a-a28696ee9c70","resolution":{"observed_at":"2026-08-07T13:23:21.194311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.11594","last_updated":"2019-09-26T03:04:58Z","snapshot_observed_at":"2026-07-31T15:31:02.049870Z","submitted_at":"2019-06-27T12:44:09Z","title":"Curriculum Learning for Deep Generative Models with Clustering","version":2},"cited_work":{"arxiv_id":"1906.11594","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.11594","snapshot_observed_at":"2026-08-07T13:23:18.859072Z","title":"Curriculum Learning for Deep Generative Models with Clustering","venue":"cs.LG","work_id":"104245e6-959b-4ff4-b409-4e2191d1cb39","year":2019},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:17.432014Z"},"links":{"cited_paper":"/paper/1906.11594","citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:7e26d27dc0f4d82d03ea6145788a4f40df37f207fb2b07fa723ab429234c2da9","observation_id":"9ad379b3-20a6-4b59-99db-860cf294c81b","resolution":{"observed_at":"2026-08-07T13:23:18.970864Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:20.974416Z","title":"An empirical study of memorization in nlp","venue":null,"work_id":"d68361eb-092f-41d3-b233-cc41bf27ffc2","year":2022},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:17.615242Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:99628e8c8813992fd064388f0ca2176f3106f004ff40478e01091cfcaceb0c53","observation_id":"3afc1406-5e8b-463d-bd2c-23e0c2d3bfff","resolution":{"observed_at":"2026-08-07T13:23:21.047632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:20.794568Z","title":", T}}, with|ST |=T!","venue":null,"work_id":"4ec17e80-25d6-4fc2-a524-fffe8ef6869d","year":null},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:17.751176Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:41acfa4bb6ddc1f7cbb7305372fb74643f22f237cd742ec3b0fb2d41fd17ca58","observation_id":"bf0e3eed-4ea1-415d-a4b1-a3f2c892a9a6","resolution":{"observed_at":"2026-08-07T13:23:20.867902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:20.645745Z","title":"Retain the top 50% individuals with the highest fitness scores for reproduction, and discard the rest","venue":null,"work_id":"413ba561-f413-48e2-9059-14740382313b","year":null},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:17.886941Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:066f2c3fb6f0720cce556ecf6262fd8de5814e10c280be94fb58b085d55fa0e2","observation_id":"1949c804-6cec-4d0f-8ce6-60671baa71ba","resolution":{"observed_at":"2026-08-07T13:23:20.728079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:20.512387Z","title":"Specifically, randomly choose two crossover points l and r such that 1≤l < r≤T , then exchange the subsequences πa l:r and πb l:r between the parents","venue":null,"work_id":"4968db9f-94cc-4685-b4ad-3740a0cc3173","year":null},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:18.049094Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:18991b0c940dbb02f0c16784c0f720c3486ca95d4fd56cae425b5817a36bc91b","observation_id":"4d3aef4b-5319-4d42-9c99-85459cc190e5","resolution":{"observed_at":"2026-08-07T13:23:20.577025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:20.372534Z","title":"This operation introduces diversity and prevents premature convergence","venue":null,"work_id":"d37c0a22-5844-47a0-a616-7f4ee849ae58","year":null},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:18.146510Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:0ffae9e9ba82c5593b12e87874d67ce17577fe0773b5a636030da951af09a9ad","observation_id":"03c17730-e14c-40b3-8d83-ef99cf9557ea","resolution":{"observed_at":"2026-08-07T13:23:20.423251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:20.241880Z","title":"The updated population then forms the basis for the next generation","venue":null,"work_id":"0a4aa0ba-6569-417b-8b61-51ca37f27c81","year":null},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:18.282976Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:91a559f335a912bfa5e3b6769b637233c935dd692158999d14cffbc38a8f38ed","observation_id":"b23b15d1-2e89-4db3-9704-86e0d181c3ac","resolution":{"observed_at":"2026-08-07T13:23:20.295019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:20.121887Z","title":null,"venue":null,"work_id":"fcb6347d-0148-4f55-88f1-873dad4333ed","year":null},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:18.398214Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:b488d285953b11db30bcc10787bf5b79fc05dbd04c59732491465126acd65bc5","observation_id":"af258ba9-0be5-4e55-ad45-dc83d3d26500","resolution":{"observed_at":"2026-08-07T13:23:20.167567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:19.996299Z","title":null,"venue":null,"work_id":"a4fdde5a-16e4-4b4f-845a-456bb507d6d0","year":null},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:18.544641Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:547e97cf613b115548112056ec5c99b056a03305f0c3ad51e4b3ebabb674de66","observation_id":"85ae5941-c52d-4bbc-9515-43189317bf57","resolution":{"observed_at":"2026-08-07T13:23:20.062878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:19.719619Z","title":null,"venue":null,"work_id":"fd217b3e-4145-40bb-af1d-fad85ba4f3a9","year":null},"citing_paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:18.667504Z"},"links":{"citing_paper":"/paper/2505.22042"},"observation_digest":"sha256:3d7074b41d07c6ce7634ee41584b4eab4b41bbaca015b159bb4f868494ec10fb","observation_id":"bf735fc0-c025-4ee1-acb3-b85f6c372853","resolution":{"observed_at":"2026-08-07T13:23:19.840224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.22042","last_updated":"2025-05-28T07:07:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T13:14:15.572742Z","submitted_at":"2025-05-28T07:07:02Z","title":"Estimating the Effects of Sample Training Orders for Large Language Models without Retraining"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":3,"verified_fuzzy":36},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2505.22042."}