{"as_of":"2026-08-13T15:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:952f3322044b7903e810a64e4b3fcaec728d751e5965cbbe89c7d8d20cc1cc14","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:59:20.994114Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.16658/citation-record","integrity":"/paper/2411.16658/integrity","json":"/paper/2411.16658/citation-record.json","paper":"/paper/2411.16658"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.904645Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.904645Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:ba05cb519973dbad184bd9a8b19ee5232d07d0ef238709dfa02a4a3180bc9717","observation_id":"6ea94a60-b37d-4e6d-80dd-ab37a6423c48","resolution":{"observed_at":"2026-08-12T12:59:20.904645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.370956Z","title":"Toward large kernel models","venue":null,"work_id":"1aacb36c-b7c5-4c18-bd76-bd256b34d5b4","year":2023},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.908848Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:dcddc26ef970eed0bb16b3d2d1faf3935887ff2a83f7845f063296fb49833fb7","observation_id":"bc85bb69-4735-44c0-93d0-cb03c6e894d8","resolution":{"observed_at":"2026-08-12T12:59:21.373995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.361389Z","title":"On the nystrom approximation for preconditioning in kernel machines","venue":null,"work_id":"90407b78-8aeb-4630-bae1-10a4976c8f6b","year":2024},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.912675Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:4eb56ffaf0cdaeb05e51091d8163e5a353226e05d5f076872a87c60c66bab877","observation_id":"1befdb95-64ae-47ab-a825-80531070eea9","resolution":{"observed_at":"2026-08-12T12:59:21.364340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.352031Z","title":"To understand deep learning we need to understand kernel learning","venue":null,"work_id":"bf4587bb-d4a6-413a-8c5d-d467af152943","year":2018},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.916587Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:e594e3957210b97ae1e5e55987e9a8195fb7f90be6c294c8eef78e2bce05c2d0","observation_id":"ba592096-a18e-4e16-980b-a26ac44cdb9a","resolution":{"observed_at":"2026-08-12T12:59:21.355306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.920263Z","title":"Reconciling modern machine-learning practice and the classical bias--variance trade-off","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.920263Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:c71291b8504da3a28f27b683189960965bb95090c033542c6984646b44743c42","observation_id":"26097c4b-241a-4240-b6b5-e4e5ab645a85","resolution":{"observed_at":"2026-08-12T12:59:20.920263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.337729Z","title":"Nytro: When subsampling meets early stopping","venue":null,"work_id":"0453ee89-326d-4f20-870e-9ca154e7eb59","year":2016},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.923633Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:22167b71d24c65d4bf266ae60862bc39c472403d532ef19a35c96cd39e3f2012","observation_id":"7e58c014-d28b-428a-b883-6993728f60c4","resolution":{"observed_at":"2026-08-12T12:59:21.340811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.926631Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.926631Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:8938939856db08021b856f3d3f94c0792d0dec0f41d29779ecf006152d2e1092","observation_id":"6bef0c54-348e-4088-b337-89c14b887d83","resolution":{"observed_at":"2026-08-12T12:59:20.926631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.323756Z","title":"Product kernel interpolation for scalable gaussian processes","venue":null,"work_id":"d9d8e717-de74-4bdb-a531-ed6f6d3c8ac2","year":2018},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.929650Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:c0ef46f264d74e3b3fabf64d8cb14bc648f912365b00f3aca9a432ddf6764b2c","observation_id":"d7a1698e-aa5d-40b6-b39a-bd5e2f8716a9","resolution":{"observed_at":"2026-08-12T12:59:21.327014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.932996Z","title":"Evaluation of neural architectures trained with square loss vs cross-entropy in classification tasks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.932996Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:91edb05933d18c73dffdbecee648258a8dd5727399b3170314548dd8681ee5ba","observation_id":"071d9ad5-bb2e-404d-8e82-1a8cd1cc1b22","resolution":{"observed_at":"2026-08-12T12:59:20.932996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.936323Z","title":"Neural tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.936323Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:7826b817969df75d158ac8058b3837bd4ffef4c4454de8f034f18f376186b654","observation_id":"604ccc4a-773c-4e94-8d39-e707133c44bb","resolution":{"observed_at":"2026-08-12T12:59:20.936323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.939146Z","title":"Speech & language processing","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.939146Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:a809babbdc77aafa0dc5f05ca41602ef4f4f867fde2fddd05ea3f3d336683d01","observation_id":"5021ec51-abf1-4eca-ae07-8502ca73e6be","resolution":{"observed_at":"2026-08-12T12:59:20.939146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.941727Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.941727Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:e26db795ba8a52ae9903ac1f4885a70a6b14239226d75631de2a80d38559fe3d","observation_id":"46f505db-b2a4-42af-bc61-79170b092c43","resolution":{"observed_at":"2026-08-12T12:59:20.941727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02862","last_updated":"2017-08-09T14:59:30Z","snapshot_observed_at":"2026-07-06T05:54:38.912241Z","submitted_at":"2017-08-09T14:59:30Z","title":"WebVision Database: Visual Learning and Understanding from Web Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02862","snapshot_observed_at":"2026-08-12T12:59:20.944007Z","title":"Webvision database: Visual learning and understanding from web data","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.944007Z"},"links":{"cited_paper":"/paper/1708.02862","citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:1be820a62204e4b26922d3beed46e3960c59f99d12f42a34450a5af99dc107f8","observation_id":"e400ff2c-32d5-4bb0-8cc3-a0ffa31ee390","resolution":{"observed_at":"2026-08-12T12:59:20.944007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.296097Z","title":"Diving into the shallows: a computational perspective on large-scale shallow learning","venue":null,"work_id":"3e5a0f81-2603-425a-be20-eb57fe45db25","year":2017},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.947512Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:7c834c47ce518ac0f8516493d6dead3466758aeee01f1640d817da52cc177447","observation_id":"58624ece-348c-49a1-8ab4-9002865cd2ae","resolution":{"observed_at":"2026-08-12T12:59:21.299439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.287778Z","title":"Kernel machines that adapt to gpus for effective large batch training","venue":null,"work_id":"097f266c-aa20-410f-8b14-69874dd0fc67","year":2019},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.951150Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:5bad48de094e5dfc201af7e7f8ad380191b984cbf27d0d0e9e131b603e2ce409","observation_id":"18f342de-016e-4d8d-aa3b-4b53cedf5d5a","resolution":{"observed_at":"2026-08-12T12:59:21.290965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.277788Z","title":null,"venue":null,"work_id":"d2b15b83-f1ad-4844-a2ae-0601bacfd74f","year":2017},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.953789Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:1da966eb6ab4ac3f82be6ef8f08ade023e337fc4931851b1e56b3d3de485d7ca","observation_id":"87d6bb66-9381-4d43-9093-a9f197707ffb","resolution":{"observed_at":"2026-08-12T12:59:21.281680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.269271Z","title":"Kernel methods through the roof: handling billions of points efficiently","venue":null,"work_id":"cf1525c9-5680-4d4e-9aff-7f91f0034317","year":2020},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.957443Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:3fe8cff3ba1de8e3d9c994fda60a41523d06e685d41be9d1231414420a14e052","observation_id":"4df88951-c05b-497d-ba0f-e6d52d31e14b","resolution":{"observed_at":"2026-08-12T12:59:21.272487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.261401Z","title":"The deep bootstrap framework: Good online learners are good offline generalizers","venue":null,"work_id":"0a759f9a-6f4e-44e2-8b6b-1905df5e5ed6","year":2021},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.961009Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:d093528410877faa8108e735f3be22290babdcea5b75949c5de877dd41b1090e","observation_id":"4ddea7fc-bdd8-439d-93fa-a310bd305358","resolution":{"observed_at":"2026-08-12T12:59:21.264492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.963864Z","title":"Librispeech: an asr corpus based on public domain audio books","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.963864Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:c75f76d5ae03d36976f2998eac8d9f005bf266e96cfa1d1129c6ae042ebf4231","observation_id":"9976cb00-a5fd-4a63-8952-fba466c057f0","resolution":{"observed_at":"2026-08-12T12:59:20.963864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.966904Z","title":"Have askotch: Fast methods for large-scale, memory-constrained kernel ridge regression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.966904Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:d0ba1ddbd446da49c9de4b7546a8e9c6ba1660c5e27f9fa018ffb63da19a1baa","observation_id":"d036c44f-23bf-4f24-9964-011d572ec4cb","resolution":{"observed_at":"2026-08-12T12:59:20.966904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.969687Z","title":"Falkon: An optimal large scale kernel method","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.969687Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:d26a1c9888b3c3434b24fa29a7505a796a478835beb48d7a1d36a5345b3d9913","observation_id":"7894c6c1-5b44-4cf7-af5f-0e057a96cab7","resolution":{"observed_at":"2026-08-12T12:59:20.969687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.243367Z","title":"Pegasos: Primal estimated sub-gradient solver for svm","venue":null,"work_id":"e8cc58a5-0209-40f6-98fd-dd1eb0d29ba1","year":2007},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.972450Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:149acb7b3d1761edf36ea815aebaab187a3e39be5e062bc07cc61834a5590d9f","observation_id":"f3cbc413-aa1f-4ebb-b8ee-82870e9d29ce","resolution":{"observed_at":"2026-08-12T12:59:21.246457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.234781Z","title":"Variational learning of inducing variables in sparse gaussian processes","venue":null,"work_id":"70ef9df5-8f41-418b-965f-f8180cf9526f","year":2009},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.975235Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:371e8ca577c24d79c2db99ee85ca1597d075c33f077e63c8e18bd732f1a61dae","observation_id":"38e94fee-525c-4363-b8e0-b1b0e1596e5d","resolution":{"observed_at":"2026-08-12T12:59:21.237899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.977951Z","title":"Towns, T","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.977951Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:d0c2bbe7c18132864b0fd10f705b2661eadd37269b800657e1d4d42e926c6024","observation_id":"732282f8-8018-42bd-bdfe-f746dee55574","resolution":{"observed_at":"2026-08-12T12:59:20.977951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.981532Z","title":"ESPnet : End-to-end speech processing toolkit","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.981532Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:9de258b20ffa2d97337d3fbfbf55821648f186ab52e11e74861b08e2caa94ae4","observation_id":"8778689e-8656-42df-9f3a-61bda855e568","resolution":{"observed_at":"2026-08-12T12:59:20.981532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.984989Z","title":"Pytorch image models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.984989Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:0478fe86543873d9519bf0774e21c14f838f5b3900708248fdfea44c2374af56","observation_id":"461d488d-a356-49ca-b87e-7bcd09d4ddc9","resolution":{"observed_at":"2026-08-12T12:59:20.984989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.221587Z","title":"Using the nystr \\\"o m method to speed up kernel machines","venue":null,"work_id":"d294c2b2-93dc-4c7e-a06c-ae28c08cad90","year":2000},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.988141Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:b26dde908441004012f4643907865e7a8235621f0aa4ab217e7914050ac2931c","observation_id":"be72936e-afa5-457e-a579-dc601eff459c","resolution":{"observed_at":"2026-08-12T12:59:21.224722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:21.210482Z","title":"Kernel interpolation for scalable structured gaussian processes (kiss-gp)","venue":null,"work_id":"747a340d-3439-4479-b39d-f647ca041598","year":2015},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.991154Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:be62c5c05cf6c17bc0a0b89d8665f003c19e79d9f7e6402e61b9fdc936aa38ec","observation_id":"82163425-e1f9-4e4a-bd39-956b6b1aef1b","resolution":{"observed_at":"2026-08-12T12:59:21.215498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:59:20.994114Z","title":"Understanding deep learning (still) requires rethinking generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T12:59:20.994114Z"},"links":{"citing_paper":"/paper/2411.16658"},"observation_digest":"sha256:93d07b1c25c66ed45a9f51f2d26a401ce47dd9df7d77f0602e45dd7c3066d98c","observation_id":"2448ed6c-a174-4cf4-b2a1-d624e4d06d4b","resolution":{"observed_at":"2026-08-12T12:59:20.994114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.16658","last_updated":"2024-11-25T18:42:13Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-12T12:49:31.365520Z","submitted_at":"2024-11-25T18:42:13Z","title":"Fast training of large kernel models with delayed projections"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2411.16658."}