{"as_of":"2026-08-05T12:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21035f44552ffdb62c87157c9d0507a8ff6d66c90cd1065cabe5bee2681f9f68","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T22:05:11.146329Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-21T22:05:41.503463Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"cited_work":{"arxiv_id":"2509.06806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.06806","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","venue":"cs.CL","work_id":"f6785876-c17b-41db-8690-db20e371e46e","year":2025},"citing_paper":{"arxiv_id":"2509.21465","last_updated":"2026-05-15T11:35:18Z","snapshot_observed_at":"2026-07-06T22:30:46.129271Z","submitted_at":"2025-09-25T19:30:39Z","title":"Talking Trees: Reasoning-Assisted Induction of Decision Trees for Tabular Data","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T22:05:11.146329Z"},"links":{"cited_paper":"/paper/2509.06806","citing_paper":"/paper/2509.21465"},"observation_digest":"sha256:0ab864364a344cb71b4432f7c22c86c02010a9573a55425ec7358372a7c9ec42","observation_id":"dbf4be86-5080-4aaf-ac33-f9f306b1869b","resolution":{"observed_at":"2026-05-21T22:05:41.506194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"cited_work":{"arxiv_id":"2509.06806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.06806","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","venue":"cs.CL","work_id":"f6785876-c17b-41db-8690-db20e371e46e","year":2025},"citing_paper":{"arxiv_id":"2512.13168","last_updated":"2026-04-15T17:46:00Z","snapshot_observed_at":"2026-07-31T12:41:54.136440Z","submitted_at":"2025-12-15T10:28:45Z","title":"Finch: Benchmarking Finance & Accounting across Spreadsheet-Centric Enterprise Workflows","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T22:43:48.618334Z"},"links":{"cited_paper":"/paper/2509.06806","citing_paper":"/paper/2512.13168"},"observation_digest":"sha256:f1cba2c4e786100f9a6be7d2f17d197e6970b7f3164b2242fa8cc12d78b9693d","observation_id":"2995f291-7801-4c4d-8206-b5eebdfbc137","resolution":{"observed_at":"2026-05-16T22:48:38.311399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.06806/citation-record","integrity":"/paper/2509.06806/integrity","json":"/paper/2509.06806/citation-record.json","paper":"/paper/2509.06806"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.16499","last_updated":"2025-06-19T17:53:28Z","snapshot_observed_at":"2026-07-06T21:44:57.091757Z","submitted_at":"2025-06-19T17:53:28Z","title":"ML-Master: Towards AI-for-AI via Integration of Exploration and Reasoning","version":1},"cited_work":{"arxiv_id":"2506.16499","doi":"10.48550/arxiv.2506.16499","metadata_source":"pith","pith_arxiv_id":"2506.16499","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2506.16499 (2025)","venue":"cs.AI","work_id":"ccdc8eb5-334a-4710-b191-154fd6fbcfe7","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2506.16499","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:570a1c3442a19e4871d80ff716482e26586ee32cd052f262a23737f6d4f86eaa","observation_id":"ab98348c-a87d-454a-ae3c-869c35827f01","resolution":{"observed_at":"2026-05-18T18:11:42.722329Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:24.59793+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:24.59793+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17121","last_updated":"2025-06-20T16:21:12Z","snapshot_observed_at":"2026-08-04T05:53:29.473121Z","submitted_at":"2025-06-20T16:21:12Z","title":"Cache Me If You Can: How Many KVs Do You Need for Effective Long-Context LMs?","version":1},"cited_work":{"arxiv_id":"2506.17121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17121","snapshot_observed_at":"2026-07-02T01:06:24.193651Z","title":"Cache me if you can: How many kvs do you need for effective long-context lms?arXiv preprint arXiv:2506.17121","venue":null,"work_id":"60c06d93-8f39-4f4f-9832-bd956666aab1","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2506.17121","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:b6505419586144e4d1ae197308c53fa2664f47be4ace9c37b1a05f5a9b1a53d3","observation_id":"afb554fe-504c-4e41-ad74-79dab74009f2","resolution":{"observed_at":"2026-05-18T18:11:42.728494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:57:14.742120Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901","venue":null,"work_id":"84780adb-76cf-44ac-a8b7-e24d4fa5c592","year":1901},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:e3e7ec369d930129696d97ba4684ab31908c24497754edeb322e8770b251ce21","observation_id":"93163b33-05ed-4713-821e-7ba7008a064a","resolution":{"observed_at":"2026-05-18T18:11:43.872959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07095","last_updated":"2025-02-26T11:57:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:34:27Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","version":6},"cited_work":{"arxiv_id":"2410.07095","doi":"10.48550/arxiv.2410.07095","metadata_source":"pith","pith_arxiv_id":"2410.07095","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","venue":"cs.CL","work_id":"a671e43f-ceab-49e7-adc3-473d802a97ca","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2410.07095","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:54582849f6f85780c24b4f2c2f24919199c05cd3b1efbf33c612e98248c486b9","observation_id":"bc36038c-3468-43e8-a1e8-9d5666dab71a","resolution":{"observed_at":"2026-05-18T18:11:42.733862Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Batch prompting: Efficient inference with large language model apis","venue":null,"work_id":"927859a4-0b69-49f8-a20c-6adb30b1700b","year":2023},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:635641a8b51bf4b0b93d29caca778398ecdb011985b5cac3bc0ec8507c1f61cc","observation_id":"69b8d4c9-f322-4782-b546-dfc99a16cb5c","resolution":{"observed_at":"2026-05-18T18:11:43.875979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1408.5456","last_updated":"2014-08-23T05:06:55Z","snapshot_observed_at":"2026-07-06T03:52:26.907088Z","submitted_at":"2014-08-23T05:06:55Z","title":"Interpreting Tree Ensembles with inTrees","version":1},"cited_work":{"arxiv_id":"1408.5456","doi":null,"metadata_source":"pith","pith_arxiv_id":"1408.5456","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpreting Tree Ensembles with inTrees","venue":"cs.LG","work_id":"5e54555c-6d11-411a-93df-11b5a55d9c95","year":2014},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/1408.5456","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:d6246e59849a4659df0a28be837524a404953b0a3897cb6239a07e570aab06ad","observation_id":"3c95f2c5-b5d7-4f8b-af76-30e1288bf36f","resolution":{"observed_at":"2026-05-18T18:11:42.739577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spreadsheetllm: encoding spreadsheets for large language models","venue":null,"work_id":"6fd281be-8ea9-4a4c-94cb-1289673aa67b","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:050f034e8af23ea001e0232a27fdbb212053752ff55d58837f94a791cb6ffbaa","observation_id":"a8213d1a-d326-40fa-b742-2020188e8cf4","resolution":{"observed_at":"2026-05-18T18:11:43.869248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1214/07-aoas148","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Predictive learning via rule ensembles","venue":"The Annals of Applied Statistics","work_id":"cb34130b-203a-477e-bf34-8ca8591f3df6","year":2008},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:b186e8a25965f2f0918d4d194965debefa6b23c6534d9624cd70e90c651db417","observation_id":"46cd683a-a937-4e25-92f8-67b717672abf","resolution":{"observed_at":"2026-05-18T18:11:42.321072Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:66edae0dbd80a2c0f89018499b3a0ff05c855b164aaf850a17cc1078d885dde0","observation_id":"1176b57b-4468-4344-9291-b161577c82c8","resolution":{"observed_at":"2026-05-18T18:11:42.745379Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:8af2247b9dc632ecbe673253e6e15d49885d91088256f9e56af3dcbab31f6bfe","observation_id":"c819cf13-6a85-4a96-97cf-2b048ca5260c","resolution":{"observed_at":"2026-05-18T18:11:42.701511Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Many-shot in-context learning in multimodal foundation models","venue":null,"work_id":"5db2e6cb-33ab-4d1c-9d66-db54c8acab18","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:5f7b9e34505a5926ee9fb5ecb94e1cf030d694f30a8a1193d8b0533da3fadc12","observation_id":"cc881240-6d74-4f52-8e25-d303c1946a62","resolution":{"observed_at":"2026-05-18T18:11:43.885987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:342849d4a0df7d7e0b14bc340dc67a172e3779a2f5ac726f2e7e21697edaa063","observation_id":"7b842f8f-3cfa-48fd-a388-1a545d74c4b1","resolution":{"observed_at":"2026-05-18T18:11:42.763004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.02085","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:39:50.612907Z","title":"arXiv preprint arXiv:2508.02085 , year=","venue":null,"work_id":"b2f5d0af-c5e3-4ee0-93fc-bead1188a3b5","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:0355d51815fa9e93978d03ac2f1dc2d1585ab9e3df22463fffac501de31a7db2","observation_id":"7f075236-578c-48c6-8b59-c5a601a37f68","resolution":{"observed_at":"2026-05-18T18:11:42.780659Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7b44cf87-930a-4f80-8537-9638730b4250","year":2022},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:e01b67fcf2b1dc054a62fd8357bdf6afc76a963367984f2893372e50312bcba0","observation_id":"5a48abb6-1eb7-4fa1-a85c-df75324efcb9","resolution":{"observed_at":"2026-05-18T18:11:43.882164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04057","last_updated":"2024-07-04T16:57:14Z","snapshot_observed_at":"2026-07-06T18:41:40.732196Z","submitted_at":"2024-07-04T16:57:14Z","title":"TALENT: A Tabular Analytics and Learning Toolbox","version":1},"cited_work":{"arxiv_id":"2407.04057","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.04057","snapshot_observed_at":"2026-06-30T07:04:21.401538Z","title":"arXiv preprint arXiv:2407.04057 , year=","venue":null,"work_id":"6b5faa7e-8460-4fb9-b594-244ec3ab9bb7","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2407.04057","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:860f72740a3787f3eb2c3cd97a0ab8bd9012ff29cfe14dd2d15787b7eb6f3503","observation_id":"7a0852a9-b254-4617-bb6e-541b207dc3bd","resolution":{"observed_at":"2026-05-18T18:11:42.706606Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.18164","doi":"10.48550/arxiv.2410.18164","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TabDPT: Scaling tabular foundation models on real data.arXiv preprint arXiv:2410.18164","venue":"arXiv (Cornell University)","work_id":"6dea29bf-5c1e-4430-8f09-25c430201a44","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:64587162be77faeceaf8e281ca1d841d2eab5dcdd8eafe1e208f4f478b7f8ee2","observation_id":"b012f7ee-6320-41b1-9dfd-a18d7f7fd4f4","resolution":{"observed_at":"2026-05-18T18:11:42.753307Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6a1d5f4b-cd41-42fe-aabe-4ec668164dcd","year":2022},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:7ec842453a6c656de26a38d2327b871db569b6c4cca55b270e311dfbf4aa1583","observation_id":"c42cbe8e-05cf-48e8-b1ad-c45d556cbb7d","resolution":{"observed_at":"2026-05-18T18:11:43.866343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:29:59.328028Z","title":"37 Wenyue Hua, Lizhou Fan, Lingyao Li, Kai Mei, Jianchao Ji, Yingqiang Ge, Libby Hemphill, and Yongfeng Zhang","venue":null,"work_id":"ed940a1a-3e19-4658-88d1-34194ac465ee","year":2022},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:f6c161ed11e0505d9db196b45a7cf7d67eb50b5542a29645824ee23e8a8dc155","observation_id":"7c66d859-976f-406d-a5a6-2662ab61302c","resolution":{"observed_at":"2026-05-18T18:11:42.344255Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-03T02:08:06.032511+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T02:08:06.032511+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tabicl: A tabular foun- dation model for in-context learning on large data","venue":null,"work_id":"17275ec1-684a-461a-a580-44623e569b27","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:c93fbd18efff03c03739a7efadc02c80013ba30c36c753d901cd9c3302b835e2","observation_id":"fd440237-b0ac-479a-be60-0c128594d535","resolution":{"observed_at":"2026-05-18T18:11:43.879289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02705","last_updated":"2021-11-04T09:29:16Z","snapshot_observed_at":"2026-08-05T03:09:36.676057Z","submitted_at":"2021-11-04T09:29:16Z","title":"Benchmarking Multimodal AutoML for Tabular Data with Text Fields","version":1},"cited_work":{"arxiv_id":"2111.02705","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2111.02705","snapshot_observed_at":"2026-07-01T14:25:46.580147Z","title":"Benchmarking multi- modal automl for tabular data with text fields.arXiv preprint arXiv:2111.02705","venue":null,"work_id":"185d7b53-4094-4369-bca8-263f398b4805","year":2021},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2111.02705","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:92a626e0af9282178e0cb4264911e8683bf8902dc96f68aee0381901171b175d","observation_id":"5f1bdac3-3be8-4479-9033-c15bfc195d33","resolution":{"observed_at":"2026-05-18T18:11:42.769640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14903","last_updated":"2024-02-22T18:14:09Z","snapshot_observed_at":"2026-07-06T17:34:16.065501Z","submitted_at":"2024-02-22T18:14:09Z","title":"Tokenization counts: the impact of tokenization on arithmetic in frontier LLMs","version":1},"cited_work":{"arxiv_id":"2402.14903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14903","snapshot_observed_at":"2026-07-02T23:17:29.468277Z","title":"Tokenization counts: the impact of tokenization on arithmetic in frontier LLMs.arXiv preprint arXiv:2402.14903","venue":null,"work_id":"9a11aa7c-fe37-494a-af3a-84dd52a8b07b","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2402.14903","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:4fe833897e24081fcdbe68984d1e1e61df03bb0270137cd7010ae0660091f936","observation_id":"9887c841-c659-443e-9963-3ee6a95ef692","resolution":{"observed_at":"2026-05-18T18:11:42.717241Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02059","last_updated":"2024-11-07T03:32:44Z","snapshot_observed_at":"2026-07-06T19:44:47.582139Z","submitted_at":"2024-11-04T13:03:13Z","title":"TableGPT2: A Large Multimodal Model with Tabular Data Integration","version":3},"cited_work":{"arxiv_id":"2411.02059","doi":"10.48550/arxiv.2411.02059","metadata_source":"pith","pith_arxiv_id":"2411.02059","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2411.02059 , year =","venue":"cs.LG","work_id":"0e72aa0c-9cce-4fe9-8d36-916de00343fe","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2411.02059","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:4f8e60255bee0e524736e1f06fd5e68682f83985771bd57aaad5ac1f6341271e","observation_id":"2b3788f0-0793-4588-96fa-e3fc3d62a133","resolution":{"observed_at":"2026-05-18T18:11:42.775039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6855.363575","doi":"10.1145/3616855.3635752","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Table meets llm: Can large language models understand structured table data? a benchmark and empirical study","venue":null,"work_id":"6c59650c-c6bb-4c4a-9d5b-1809fd07399d","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:4dc4cfcba496bdf79e4a525062da7aa0831dc72a885a7af2acbcb9bafbefa4ab","observation_id":"1773ca3b-948a-428c-9d1c-8789d5338f68","resolution":{"observed_at":"2026-05-18T18:11:42.340199Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eric Wallace, Yizhong Wang, Sujian Li, Sameer Singh, and Matt Gardner","venue":null,"work_id":"e4103a62-5d3d-415c-a1e0-ab849b214e48","year":2019},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:4e60f1a99620ec647b84a8c061462162c696fe6ed64cb6078ffea2cfd58c7de8","observation_id":"904ef3b0-0524-40c8-aa89-adfe29a95e99","resolution":{"observed_at":"2026-05-18T18:11:43.860032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.16291","doi":"10.18653/v1/2023.emnlp-main.118","metadata_source":"pith","pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","venue":"cs.AI","work_id":"ffe0d207-86cf-4742-a100-e988ac8b9676","year":2023},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:904afa0c6dc90b5109f80a6dd755782de3fd997fa0d4656cadf3cd09d069b2ef","observation_id":"2dcc0688-5127-4cc1-aadd-32987b06b15a","resolution":{"observed_at":"2026-05-18T18:11:42.328709Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:981d4a4b3adb7b5903a3e17b35f4bfe155a5c144bb6899f9cfc7d098ad0e99bd","observation_id":"e5c17c4b-f57a-4e75-9aea-5631a513aa88","resolution":{"observed_at":"2026-05-18T18:11:42.686429Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03147","last_updated":"2025-02-05T13:16:41Z","snapshot_observed_at":"2026-07-06T20:31:32.157039Z","submitted_at":"2025-02-05T13:16:41Z","title":"Scalable In-Context Learning on Tabular Data via Retrieval-Augmented Large Language Models","version":1},"cited_work":{"arxiv_id":"2502.03147","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03147","snapshot_observed_at":"2026-06-30T08:14:25.773066Z","title":"Agent workflow memory","venue":null,"work_id":"baca41e9-8d12-4cc7-84ab-53ba8ced5f47","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2502.03147","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:db870976fd3328e9973d72a74ff5e0c9ac6a4bf568d7d5c9a620d46bcbec696b","observation_id":"3a837242-e486-4566-839e-124b1db37896","resolution":{"observed_at":"2026-05-18T18:11:42.691733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Effective long-context scaling of foundation models","venue":null,"work_id":"49a13f0b-cd9c-4b87-8d64-a396bd53ac6a","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:e605de54d70a530fbb33589f89750a3a78ae1fa150094950ea66f2416cf80d49","observation_id":"f70d0a6d-9364-4100-aa52-587760f53c9c","resolution":{"observed_at":"2026-05-18T18:11:43.889298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.14738","doi":"10.48550/arxiv.2505.14738","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R&d-agent: Automating data-driven ai solution building through llm-powered automated research, development, and evolution","venue":"ArXiv.org","work_id":"e2b911a1-ed00-46c4-bb7c-4a2a6ba115ae","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:622fcd1d5413088fcbafd1a0fe60cb71ebbd4fa3e3e239e3ab052e04b3bda666","observation_id":"2eafef5d-91b8-4ca6-9ed2-91683aa3a8c3","resolution":{"observed_at":"2026-05-18T18:11:42.711964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2407.00956","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T16:47:09.099031Z","title":"arXiv preprint arXiv:2407.00956 , year=","venue":null,"work_id":"21dd0277-797e-4e77-b0e7-6451e24d16a3","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:bbe2593c7ff29aa92f076a7701fe55fc72f1e60ffa6311cf5c069a28c69b8744","observation_id":"b92d6718-0038-4efd-9e41-5bc655c0186f","resolution":{"observed_at":"2026-05-18T18:11:42.697236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"More is not always better? enhancing many-shot in-context learning with differ- entiated and reweighting objectives","venue":null,"work_id":"4d2597b8-892b-4fad-a0f4-407d6b624330","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:a28b62888a076550e97932833f167b1fd4134fc03f74de289594360acc4cc47b","observation_id":"f8adb186-51a4-48a1-9bd1-deee20895f6d","resolution":{"observed_at":"2026-05-18T18:11:43.863565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zihao Zhao, Eric Wallace, Shi Feng, Dan Klein, and Sameer Singh","venue":null,"work_id":"3053be02-c4c4-4bca-8b3e-4ff754c532ed","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:f331b21c9c55a43581005005e3dfe1fb23484826ef964494209435955117699a","observation_id":"0436ef9e-474f-49ed-92fc-7d167740b6bd","resolution":{"observed_at":"2026-05-18T18:11:43.856005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":"2403.13372","doi":"10.48550/arxiv.2403.13372","metadata_source":"pith","pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","venue":"cs.CL","work_id":"462b3287-e058-48e3-b5e3-82a5f2a8dc06","year":2024},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:828fc2336d07bcd8cf0707d76c6acc2e9a1fe2eba52e26ef5975a002e5aeb078","observation_id":"3164e218-06d2-435f-8bb3-b53d531ee9cf","resolution":{"observed_at":"2026-05-18T18:11:42.758003Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.1245","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ISBN 979-8-89176-251-0","venue":null,"work_id":"48ac9638-2f4c-4877-9322-869856030457","year":2025},"citing_paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining","version":6},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T18:09:18.157131Z"},"links":{"citing_paper":"/paper/2509.06806"},"observation_digest":"sha256:952067502b6cb57beee46b8e16ba36a48480a79d8d68a5bb4d0631008038f337","observation_id":"20e1347b-a591-4c3c-a72f-e6dfcb07d950","resolution":{"observed_at":"2026-05-18T18:11:42.333901Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.06806","last_updated":"2026-04-11T15:54:00Z","latest_version":6,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T22:25:58.615083Z","submitted_at":"2025-09-08T15:38:31Z","title":"MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":10,"parse_uncertain":0,"unresolved":2,"verified_exact":13,"verified_fuzzy":9},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 2 inbound Pith citation observations for arXiv:2509.06806."}