{"as_of":"2026-08-18T18:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5be9db7fc4d3f56f2f704d5ee0cf4253723c0b05e2a51948fc6072382bc1fabc","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T12:34:33.812415Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07224/citation-record","integrity":"/paper/2608.07224/integrity","json":"/paper/2608.07224/citation-record.json","paper":"/paper/2608.07224"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.540246Z","title":"Scale-sensitive dimen- sions, uniform convergence, and learnability.Journal of the ACM, 44(4):615–631, 1997","venue":null,"work_id":"00fd5b8f-c5be-4bcc-9af4-f283664c3fe7","year":1997},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.615398Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:1f02c070b4d3955796b5b866c01e49e5091a74da1799fb26e14a116fd8878e7d","observation_id":"3905ed4f-6b8e-46e5-b7d2-01772eb5f192","resolution":{"observed_at":"2026-08-10T12:34:34.544336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.619894Z","title":"Bartlett.Neural Network Learning: Theoretical Foundations","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.619894Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:695d60b33adca51a2e06fb535fd4a3a9c3fa60d9d735fd6e101c4d0696a673fa","observation_id":"a96662a3-19c6-4130-a663-ee7b8e414720","resolution":{"observed_at":"2026-08-10T12:34:33.619894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.518999Z","title":"Bartlett, Philip M","venue":null,"work_id":"29656638-744a-466e-977c-fa560092d4dd","year":1996},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.623764Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:62855ddf20157e2babbea87693e2565e2dc957d67f5a6fe718dbfc15d226476f","observation_id":"9e173dcd-cf51-4010-8ee2-760d54bc8aef","resolution":{"observed_at":"2026-08-10T12:34:34.523625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.627907Z","title":"Cambridge Univer- sity Press, 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.627907Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:215fd6453bb6f8a41e819e706d2fdedd0ce9527e578e5277d12efabc42b55878","observation_id":"24767e67-d6ee-4bf5-9c1d-ba24ded21d31","resolution":{"observed_at":"2026-08-10T12:34:33.627907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.631857Z","title":"Cover and Joy A","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.631857Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:ae4db74e8e20b98d186f51334f3c82de21e9869e1c32879b6fe5d4835926dce4","observation_id":"51ef4bad-d23e-45e5-9d4f-4f64232ccb19","resolution":{"observed_at":"2026-08-10T12:34:33.631857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.490004Z","title":"Freedman","venue":null,"work_id":"fa5daf7e-11a0-4d75-9fe9-6ea3f199682e","year":1975},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.635751Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:7e1fea4b936ef305d39983e44090e5fe30c82f46aa661787cb1af80675674116","observation_id":"aa61babc-4933-4e82-bd5e-8225a7e3e21c","resolution":{"observed_at":"2026-08-10T12:34:34.493705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.639979Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.639979Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:5fc1f42b7b281e362046d74b2e8696284211a1ed8b60d8b7580a9057fef6adc9","observation_id":"59d67649-efb5-4087-84ec-1fc24f22aac0","resolution":{"observed_at":"2026-08-10T12:34:33.639979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.471987Z","title":null,"venue":null,"work_id":"4ce87fdb-0bd9-4911-89e9-d1dc061470ea","year":1952},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.643614Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:3eaf1d7f7e90814367afdab6549132d116466c7917157266b18d9f05b2992bad","observation_id":"74c567b4-74ba-4a5d-9039-bfbf14bdeb0d","resolution":{"observed_at":"2026-08-10T12:34:34.475666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12013","last_updated":"2026-04-18T18:57:54Z","snapshot_observed_at":"2026-07-06T23:00:17.634307Z","submitted_at":"2026-04-13T20:00:13Z","title":"Sample Complexity of Autoregressive Reasoning: Chain-of-Thought vs. End-to-End","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12013","snapshot_observed_at":"2026-08-10T12:34:33.647346Z","title":"Sample complexity of autoregressive reasoning: chain-of-thought vs","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.647346Z"},"links":{"cited_paper":"/paper/2604.12013","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:237df221e3b9ab0d7973cd44e5137e99c92b9885f308f421fbc9864165c20a11","observation_id":"c6243f71-98f1-4d3c-9376-697f72b8a026","resolution":{"observed_at":"2026-08-10T12:34:33.647346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.461054Z","title":"Decision theoretic generalizations of the PAC model for neural net and other learning applications.Information and Computation, 100(1):78–150, 1992","venue":null,"work_id":"fc77c962-cf5c-4092-b8cb-b21c100a6a6f","year":1992},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.651274Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:806cb9eab14c80681de26301dce14f48d013b2e862e8bb7bc6330bad677c7bdd","observation_id":"7668f925-1a5d-42c9-ad73-5cc2b8d7c796","resolution":{"observed_at":"2026-08-10T12:34:34.464899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12316","last_updated":"2026-05-12T16:01:29Z","snapshot_observed_at":"2026-08-16T23:16:20.633409Z","submitted_at":"2026-05-12T16:01:29Z","title":"Autoregressive Learning in Joint KL: Sharp Oracle Bounds and Lower Bounds","version":1},"cited_work":{"arxiv_id":"2605.12316","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.12316","snapshot_observed_at":"2026-08-10T12:34:34.094782Z","title":"Autoregressive Learning in Joint KL: Sharp Oracle Bounds and Lower Bounds","venue":"cs.LG","work_id":"29eb8b9f-171c-4b8b-817a-d3c3185cf61b","year":2026},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.654890Z"},"links":{"cited_paper":"/paper/2605.12316","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:f5fbe10c6990993d8084a7a095ef7f9c3792030646c19f2819dfb15bffdcd6dc","observation_id":"fe6554e9-6a08-44d0-8d41-7e1c03ae4b3e","resolution":{"observed_at":"2026-08-10T12:34:34.099066Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.449874Z","title":"A theory of learning with autoregressive chain of thought","venue":null,"work_id":"585bb4ac-579e-47c1-a04a-f7ac969349f4","year":2025},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.659101Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:25f56831853383892140c15ed7d82d36210894a0323a5d0a34e0a2d4b52d6d16","observation_id":"ed9853da-eb62-4052-9677-7d21c433118f","resolution":{"observed_at":"2026-08-10T12:34:34.453998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.437718Z","title":"Entropy and the combinatorial dimension.Inven- tiones Mathematicae, 152(1):37–55, 2003","venue":null,"work_id":"23931ef6-c463-45fc-9075-f8d082db87a9","year":2003},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.662712Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:7cdf3a5bf4270cd044755ea3e39acbba973dd1d454f95fc128516735a626ede8","observation_id":"8d9352b6-8a1e-4f50-a5f6-7a5aab99be32","resolution":{"observed_at":"2026-08-10T12:34:34.441801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.425945Z","title":"Combinatorics of random processes and sections of convex bodies.Annals of Mathematics, 164(2):603–648, 2006","venue":null,"work_id":"4db7b778-79bc-4bee-af0b-5f7e63e24210","year":2006},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.666309Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:3a75ac506ffec8357fc96ad4da795e63ba71dace44108a5600ba5393a58ec048","observation_id":"a3464d94-7c82-4d65-a80d-02841d755af9","resolution":{"observed_at":"2026-08-10T12:34:34.430177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.414360Z","title":"Tsybakov.Introduction to Nonparametric Estimation","venue":null,"work_id":"474281a0-9335-4542-8b92-0e3b0d2e7076","year":2009},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.669863Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:fb1f132eaeb74766811e1f29b8e5fccf312fb20447fa6a44f551f7b75087e689","observation_id":"d80d09d3-d3e9-4997-873e-4013d1ff178b","resolution":{"observed_at":"2026-08-10T12:34:34.418557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.673683Z","title":"van de Geer.Empirical Processes in M-Estimation","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.673683Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:4fb1c79b749782b36ed8fae40b9df6624a7570a5dad2545c10632522506c0e79","observation_id":"fc551f15-46ed-41de-b8de-f34335c3c0ef","resolution":{"observed_at":"2026-08-10T12:34:33.673683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.398162Z","title":"A game of prediction with expert advice.Journal of Computer and System Sciences, 56(2):153–173, 1998","venue":null,"work_id":"bb55b760-743d-4c17-ac03-f1afc2426691","year":1998},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.677238Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:910f7d980c9a7fffd9eb7c78c19651e986f5e2c5d690a290ec113063b26ce221","observation_id":"8d6c8426-9051-4623-ad3b-88b921beae02","resolution":{"observed_at":"2026-08-10T12:34:34.401631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.387922Z","title":"Optimal learning with Q-aggregation.The Annals of Statistics, 42(1):211–224, 2014","venue":null,"work_id":"ed30970f-dd24-49b1-95e0-197ba3d23364","year":2014},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.680740Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:9dd10ef948c44d93536bd917173d2729be302ad80b8873d293a2f7441d1bac1b","observation_id":"a7911910-4242-4039-8a8b-d5b3b1dbde2a","resolution":{"observed_at":"2026-08-10T12:34:34.391308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.378659Z","title":"Noise-tolerant learning, the parity problem, and the statistical query model.Journal of the ACM, 50(4):506–519, 2003","venue":null,"work_id":"1e91998b-a130-4f48-ba95-7ceccd393648","year":2003},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.684347Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:7f858db0debc56417e94ce19149066909453e14a1fb5941418e7891b292ea8dd","observation_id":"42cf11da-6b0b-41d1-91a5-730342c8a1d0","resolution":{"observed_at":"2026-08-10T12:34:34.381949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.368437Z","title":"Assouad, Fano, and Le Cam","venue":null,"work_id":"148393e0-cdb1-4cca-a9db-5212ac487b64","year":1997},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.687877Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:a35482ecc1d86965792c3a2c1bd20abf7e7fecb6160885e1b95148c9a1db2624","observation_id":"2439f7b5-9e6c-46fa-bace-69cdd6c9115a","resolution":{"observed_at":"2026-08-10T12:34:34.372037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.690864Z","title":"Springer, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.690864Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:30b1dcca2a9f14ead0a2cd12e865c5dcef9569a5052ba61f3e483989acfa2fa6","observation_id":"fdbb176a-1e92-46d6-837f-4e2b05db3503","resolution":{"observed_at":"2026-08-10T12:34:33.690864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.350807Z","title":"InAdvances in Neural Information Processing Sys- tems, 2025","venue":null,"work_id":"416f4a51-0e15-4e71-b9a6-ca82d896e2ed","year":2025},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.694029Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:061c3fcbb80c5a83577e7178665637156bd315d1bc99dfc73c723a9f91b9ec94","observation_id":"0a2f92e2-82b6-401e-ac85-c44d41b39860","resolution":{"observed_at":"2026-08-10T12:34:34.354861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.339777Z","title":"Learning probabilistic automata: A study in state distinguishability.Theoretical Computer Science, 473:46–60, 2013","venue":null,"work_id":"22c169cd-f057-4737-953f-86339dc5b8d4","year":2013},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.697305Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:e68ec3d519ec057a7da87f492ffa52f768711413b41b276e95bd7383a6df6174","observation_id":"4a319686-d4c3-4ae1-943d-d550b0ae7c24","resolution":{"observed_at":"2026-08-10T12:34:34.343773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.328909Z","title":"PAC-learnability of probabilistic deterministic finite state automata.Journal of Machine Learning Research, 5:473–497, 2004","venue":null,"work_id":"4cfe01a0-207a-478f-ac80-d88003c24979","year":2004},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.700948Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:995bd2c3a0946fd802f8895f9627eedeb2e79941bfb17d12bed87eba430e2d70","observation_id":"0440a4dc-2c51-46a9-80ab-ad9ca0248ab8","resolution":{"observed_at":"2026-08-10T12:34:34.332788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06819","last_updated":"2026-05-07T18:21:05Z","snapshot_observed_at":"2026-08-14T10:56:42.107690Z","submitted_at":"2026-05-07T18:21:05Z","title":"A Theory of Online Learning with Autoregressive Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06819","snapshot_observed_at":"2026-08-10T12:34:33.704139Z","title":"A theory of online learning with au- toregressive chain-of-thought reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.704139Z"},"links":{"cited_paper":"/paper/2605.06819","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:76b3fd01e483a916fbdd0b0c8c52c0da142cf9c0af8fb25bdd79269982675802","observation_id":"b77ff619-cfd7-4b11-a85f-513638751ed3","resolution":{"observed_at":"2026-08-10T12:34:33.704139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.316989Z","title":"Efficient noise-tolerant learning from statistical queries","venue":null,"work_id":"31e239f8-9899-46dc-917f-31e8142365a8","year":1993},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.708105Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:f3e27583933fad52362810a8f38b664d35a21610032c0ed694ed004dd4992b17","observation_id":"e75417d2-a315-4784-a1cf-666edc7581e9","resolution":{"observed_at":"2026-08-10T12:34:34.320932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.305826Z","title":"Kearns and Robert E","venue":null,"work_id":"dd9e7dfc-2fd4-4fb9-b0e9-e8ad8aecdd99","year":1994},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.711592Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:3fb424827769a116b98b32c81d7063acd5208fa2c3fa02201f3daa941547dd63","observation_id":"bc86a67f-f58f-43cd-b927-b922731d1851","resolution":{"observed_at":"2026-08-10T12:34:34.309404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.295326Z","title":"Kearns and Leslie G","venue":null,"work_id":"ce242feb-30d1-46e9-bf31-e45a7570f534","year":1994},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.715974Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:d814e69ef4e6bd24653bfd32d01e21ae5512ebc4947939bc2dd4a0fcb7208c61","observation_id":"dc315933-ac58-4c10-b26c-9e32de7c93e5","resolution":{"observed_at":"2026-08-10T12:34:34.298702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.719465Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.719465Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:d6494bd6dad46d3bb853b9c7be5755553d116e1b0fb1025877afc67e73fdf4af","observation_id":"df62f908-ebe6-4795-90d9-4b197573699b","resolution":{"observed_at":"2026-08-10T12:34:33.719465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.278528Z","title":"Tight sample complexity of transformers","venue":null,"work_id":"2432dd96-f99e-42c2-8466-afbd752316c6","year":2026},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.723159Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:ed24ce5bb8cb105f29ce8d7955a027e4d5aa0024d2ed41dd455d28300a132b0d","observation_id":"e93e1506-a3ae-41f5-b808-941abd05b3b9","resolution":{"observed_at":"2026-08-10T12:34:34.282276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.726853Z","title":"Chain of thought empowers transformers to solve inherently serial problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.726853Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:cc6b777491e30096fa1fd3f1038fe868693fcdac0015bcd8033ce8eb05d2cc48","observation_id":"b3ef4cc2-2631-49c8-8868-db85bbe34c36","resolution":{"observed_at":"2026-08-10T12:34:33.726853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-10T12:34:33.730461Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.730461Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:776d29be9f9c3694c83151ccf194879e98fda6d3f5913cb3d6740734f716f100","observation_id":"86caf0be-913f-49e0-8e40-8f27a289ed6c","resolution":{"observed_at":"2026-08-10T12:34:33.730461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07923","last_updated":"2024-04-11T18:03:53Z","snapshot_observed_at":"2026-08-16T23:21:29.490443Z","submitted_at":"2023-10-11T22:35:18Z","title":"The Expressive Power of Transformers with Chain of Thought","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07923","snapshot_observed_at":"2026-08-10T12:34:33.735023Z","title":"The expressive power of transformers with chain of thought","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.735023Z"},"links":{"cited_paper":"/paper/2310.07923","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:7efe291af27c8cecbc145e90462737e9c3553f9e160232a4584c313adda8bf98","observation_id":"c13b37dc-a14e-4112-9671-30a536847586","resolution":{"observed_at":"2026-08-10T12:34:33.735023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00114","last_updated":"2021-11-30T21:32:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-30T21:32:46Z","title":"Show Your Work: Scratchpads for Intermediate Computation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00114","snapshot_observed_at":"2026-08-10T12:34:33.739942Z","title":"Show your work: Scratchpads for intermediate computation with language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.739942Z"},"links":{"cited_paper":"/paper/2112.00114","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:1ad8825f25ee3a8bc05d7a4f7d3ecc1da8e09bf51b59fa0643ecf0c1e3d81786","observation_id":"cd532ae2-c0ff-45bf-8964-94886e342161","resolution":{"observed_at":"2026-08-10T12:34:33.739942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.260611Z","title":"A new learning paradigm: Learning using privileged information.Neural Networks, 22(5–6):544–557, 2009","venue":null,"work_id":"3a61aafb-f273-4419-a739-5ccd18bebe22","year":2009},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.743917Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:1810f365f866df840564864b9c6af41f7971d7581dfa337357019aaf40186799","observation_id":"c1596d0e-c7c8-42ca-9a8d-815b5cb0ec3e","resolution":{"observed_at":"2026-08-10T12:34:34.264960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-10T12:34:33.748111Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.748111Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:1657565dedac3cf29a445bff0fd9e2a4671418e727e40e195dcb27170da7c128","observation_id":"98d84774-4dac-49f8-aafa-4f84cc46d019","resolution":{"observed_at":"2026-08-10T12:34:33.748111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.249582Z","title":"Le, and Denny Zhou","venue":null,"work_id":"ed6cb791-b708-4726-bf1b-5d783949f7bd","year":2022},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.751816Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:8d206c2b2382f7921caf609ca02efb7a04f5ec7d50c219e926cd72899d5a5002","observation_id":"8b8ed332-3001-4a94-80a4-afb9c236c70e","resolution":{"observed_at":"2026-08-10T12:34:34.253353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.238037Z","title":null,"venue":null,"work_id":"772b4a7a-bbfa-4da4-a145-7a9520ed4210","year":2022},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.755452Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:fe1b409d1bed7af9e0e27544017de450d2a7b0c291a9794ef10f586f4c71238a","observation_id":"c1b3b3fa-fdf6-4c26-b850-e4cdcc614157","resolution":{"observed_at":"2026-08-10T12:34:34.241884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.227301Z","title":"van der Vaart and Jon A","venue":null,"work_id":"d0fa85d7-4f66-44ad-9aee-e2b154c37a3e","year":1996},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.759317Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:ec6eaf1e4de34160a17142471d6e57320f20e4d41174c453dd01d1983ad57926","observation_id":"5baccdd8-4f5e-4662-ba9c-047ff0a10c0b","resolution":{"observed_at":"2026-08-10T12:34:34.230498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.763005Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.763005Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:b4774df09592ccaf1e0e255f427af96f8817c6bf36a58994c3afb5d1872718a1","observation_id":"41990733-4c5b-497d-a14a-a4d8ef0ea746","resolution":{"observed_at":"2026-08-10T12:34:33.763005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.209976Z","title":"Foster, Adam Block, and Dipendra Misra","venue":null,"work_id":"160541fc-4e22-4d22-8799-3c4c4b5ebfeb","year":2024},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.766825Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:5594d9865afbb5cb416729ddc2d9e76f2f174490c3cda2eebec6eedc5c3a400a","observation_id":"8bafdcde-cd99-4a87-9352-4df157ab5a38","resolution":{"observed_at":"2026-08-10T12:34:34.213290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.199644Z","title":null,"venue":null,"work_id":"7fe57fe8-be24-42eb-bc91-457d6b1c3a51","year":2020},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.770532Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:e75101cf7f7b6b98b9bae4c38e1e9a5bee485215580807cfdfa18f5aaa59b1d9","observation_id":"7b07d3e8-6e09-4126-8111-a369dd62a425","resolution":{"observed_at":"2026-08-10T12:34:34.202905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.189358Z","title":null,"venue":null,"work_id":"3b009ab2-16eb-47c7-ab24-da3c4a452880","year":2022},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.774347Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:422d9833f9839352c395f36593a32aaf7906598009a0b5072fec744f47116486","observation_id":"713dec25-e5d9-48e5-89c5-ee71d9c9404c","resolution":{"observed_at":"2026-08-10T12:34:34.193056Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.778097Z","title":"The curious case of neural text degeneration","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.778097Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:09fad2d60ce93b18f892591121522949bdf0a66f76fcc862596c7dcd21feed69","observation_id":"24df52ef-d409-44e7-803a-a4864f251f96","resolution":{"observed_at":"2026-08-10T12:34:33.778097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.027880Z","title":null,"venue":null,"work_id":"18011c00-8f2f-4d08-8434-8c7dff0cfcd9","year":1989},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.781725Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:23bda7055529a7bb43715e90c49c9a440499364042e9136835d52b152adefb9c","observation_id":"33d27bf2-053f-46d0-a485-93a7b5ca680f","resolution":{"observed_at":"2026-08-10T12:34:34.031701Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.170562Z","title":"Wiley, 1986","venue":null,"work_id":"9419cc96-6816-49d9-bdce-04d2ba8786b7","year":1986},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.785173Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:bf2211e5c3e3bf3c2165cfcc1dc9cec1d5493c0bd42909588a471e8021e7ca21","observation_id":"12d3a31b-15bf-449c-a8c1-5863232a7179","resolution":{"observed_at":"2026-08-10T12:34:34.174406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.159072Z","title":null,"venue":null,"work_id":"5ff319bd-dc99-4179-b5bd-410ed3bde084","year":1995},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.788527Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:6c3435c93b6d83c14043475dbedd7dc4a2214006d572b594f8c7fb5787310191","observation_id":"c4f40ca5-a4f2-4342-9fe8-20b4d30ea797","resolution":{"observed_at":"2026-08-10T12:34:34.162938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24737","last_updated":"2026-04-27T17:43:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-27T17:43:44Z","title":"Learning to Think from Multiple Thinkers","version":1},"cited_work":{"arxiv_id":"2604.24737","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.24737","snapshot_observed_at":"2026-08-10T12:34:33.870240Z","title":"Learning to Think from Multiple Thinkers","venue":"cs.LG","work_id":"7dda8890-1201-4d27-a2bc-b5bf2acf7a35","year":2026},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.792014Z"},"links":{"cited_paper":"/paper/2604.24737","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:3b62d048162605d8be35aab22b74d99d7cca6260adf469f75b4caa291498e7b0","observation_id":"7207437e-a569-40b1-8422-55655cb05d5d","resolution":{"observed_at":"2026-08-10T12:34:33.874931Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:33.795703Z","title":"Griffiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.795703Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:d6b74dfefb520223d037683b4b083a1c7888f237a92a81a6d61398ad39392ac1","observation_id":"17ccd7a2-6ece-475a-bb43-dbbe5b16b3a2","resolution":{"observed_at":"2026-08-10T12:34:33.795703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-10T12:34:33.798985Z","title":"Solving math word problems with process- and outcome-based feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.798985Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:8942f7729501179ae3248ad97948928f833ddeeee154e506ae732536313bc7bf","observation_id":"d7c14c93-f8c4-48ac-b1b3-0c63acea38f9","resolution":{"observed_at":"2026-08-10T12:34:33.798985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.140956Z","title":"From sparse dependence to sparse attention: Unveiling how chain-of-thought enhances transformer sample efficiency","venue":null,"work_id":"f589244b-8449-46f7-8d1e-a00fbaee0d76","year":2025},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.802816Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:f38ee4b1abab5ad5f2edaabf90093607d09283ac09cf353c0ebdce060d6e5f38","observation_id":"be6ecfc5-815d-4250-9d15-4ec9434e021f","resolution":{"observed_at":"2026-08-10T12:34:34.145031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.129752Z","title":null,"venue":null,"work_id":"bc093ab7-88e7-417c-91ca-4d3fa4ee0408","year":2025},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.806088Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:a9cb37e3184c882ddff9ac864891de1078a92d20eeab692cb6c069ccb2e385fd","observation_id":"c95f617e-f98f-4939-90c7-d414f22ceb6a","resolution":{"observed_at":"2026-08-10T12:34:34.133452Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T12:34:34.118017Z","title":"Auto-regressive next-token predictors are universal learners","venue":null,"work_id":"21fdb2c1-ea5e-44cf-8303-96253f058ba8","year":2024},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.809217Z"},"links":{"citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:73cf1c02754f8c878e676751c33ae5d073fcf204423e85b780a75d7852ccc095","observation_id":"17c4a9b4-6d29-457e-bbd2-6b5eb8632d13","resolution":{"observed_at":"2026-08-10T12:34:34.121960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.07423","last_updated":"2026-07-08T13:49:54Z","snapshot_observed_at":"2026-08-15T08:18:54.062360Z","submitted_at":"2026-07-08T13:49:54Z","title":"The Optimal Sample Complexity of Learning Autoregressive Chain-of-Thought","version":1},"cited_work":{"arxiv_id":"2607.07423","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.07423","snapshot_observed_at":"2026-08-10T12:34:33.842086Z","title":"The Optimal Sample Complexity of Learning Autoregressive Chain-of-Thought","venue":"cs.LG","work_id":"ccdd086d-50c6-42d5-a9f1-f190d708ef2a","year":2026},"citing_paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T12:34:33.812415Z"},"links":{"cited_paper":"/paper/2607.07423","citing_paper":"/paper/2608.07224"},"observation_digest":"sha256:294a54ff4658fb608ab7fe382d6b3bcead466bedcc6d138bd40d470b3814bd36","observation_id":"909e4c81-52d7-40f0-a357-884a0b0c83b2","resolution":{"observed_at":"2026-08-10T12:34:33.848090Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.07224","last_updated":"2026-08-07T13:40:17Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T06:32:16.414473Z","submitted_at":"2026-08-07T13:40:17Z","title":"Stochastic Autoregressive Learning"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":4,"verified_fuzzy":26},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2608.07224."}