{"as_of":"2026-08-09T03:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3ae829b23b7304c5de7e33a0e19f38cf9cc0890edbae9f3a102dc383081f840d","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:59:57.163858Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03503/citation-record","integrity":"/paper/2509.03503/integrity","json":"/paper/2509.03503/citation-record.json","paper":"/paper/2509.03503"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.06302","last_updated":"2022-09-13T21:09:34Z","snapshot_observed_at":"2026-07-06T13:51:58.712399Z","submitted_at":"2022-09-13T21:09:34Z","title":"Optimization without Backpropagation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.06302","snapshot_observed_at":"2026-08-05T10:59:56.170025Z","title":"Optimization without backpropagation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.170025Z"},"links":{"cited_paper":"/paper/2209.06302","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:622ead7c656d77c17a1b00516c8c0fdbd84ac63da1fafc5f2aafce377cbec1d8","observation_id":"553782f1-621e-4dc0-9aab-f1cddcae824e","resolution":{"observed_at":"2026-08-05T10:59:56.170025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.32141","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:57.788626Z","title":"Cristiano Gratton, Naveen K","venue":null,"work_id":"c949b6c5-4d40-44d8-9d99-dcb51060a35c","year":2022},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.363742Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:77ea4f59b9ce9540b347c364957354361f7e8c5f9b1008f4fded209c7c83c00b","observation_id":"b6cba81b-ae3e-47d7-9a37-b44f895ca68a","resolution":{"observed_at":"2026-08-05T10:59:57.881652Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.31392","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:57.574194Z","title":"Kaiming He, Xiangyu Zhang, Shaoqing Ren, and Jian Sun","venue":null,"work_id":"dfdbe5fe-dc3d-447a-9e44-e9d162aa1472","year":2021},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.423984Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:5619135823e4fc499098d7d9c59c5f64b6486fb5a837efd4b49c7bdcad9567a4","observation_id":"634e1e70-bf53-42bd-a622-5bf6ff4daa37","resolution":{"observed_at":"2026-08-05T10:59:57.642043Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05613","last_updated":"2021-09-12T21:06:07Z","snapshot_observed_at":"2026-08-09T00:14:21.791238Z","submitted_at":"2021-09-12T21:06:07Z","title":"Critical Learning Periods in Federated Learning","version":1},"cited_work":{"arxiv_id":"2109.05613","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.05613","snapshot_observed_at":"2026-08-05T10:59:57.335704Z","title":"Critical Learning Periods in Federated Learning","venue":"cs.LG","work_id":"ae277fd3-d928-48a5-b8d8-096402521d36","year":2021},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.843424Z"},"links":{"cited_paper":"/paper/2109.05613","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:17518eedb90376647942140d70a085a2e3fce0d73fae3ae701a40d0632433e91","observation_id":"560da3f1-4c5b-400f-8ddb-f3a99df74fe2","resolution":{"observed_at":"2026-08-05T10:59:57.405315Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.00582","last_updated":"2022-07-21T12:33:15Z","snapshot_observed_at":"2026-07-06T06:42:35.645776Z","submitted_at":"2018-06-02T04:45:58Z","title":"Federated Learning with Non-IID Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.00582","snapshot_observed_at":"2026-08-05T10:59:56.953435Z","title":"Federated learning with non-iid data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.953435Z"},"links":{"cited_paper":"/paper/1806.00582","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:ed70eccc780ada9d5ace16b81f48d978e0e839511e8f9869725aacd62d15166c","observation_id":"92ca0ac0-8cfd-4018-a0f4-ad66b029595f","resolution":{"observed_at":"2026-08-05T10:59:56.953435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:58.179001Z","title":"The Rademacher distribution exhibits considerably lower variance and better overall accuracy than the Gaussian distribution","venue":null,"work_id":"2bd0d499-c1c7-48e0-9154-8653071979fc","year":2020},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:57.163858Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:b9c89d747349eaaa32929476fc67b59e16f3102b0576448eddcdf8cf23bf895e","observation_id":"059722c0-de5f-48b2-8dfb-f0575400e967","resolution":{"observed_at":"2026-08-05T10:59:58.252085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:56.741954Z","title":"A Vaswani","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.741954Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:bce6b4615906f00c7ba06ace9d52980f24c0b57c84fb674c6b65d678a78886cc","observation_id":"c06244c9-ddd9-4c71-97ba-b06d0d178b00","resolution":{"observed_at":"2026-08-05T10:59:56.741954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:58.491115Z","title":"cs.toronto.edu/˜kriz/learning-features-2009-TR.pdf","venue":null,"work_id":"ff2170d4-e05b-4081-afa1-0b6af0677dfb","year":2009},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.502075Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:8e6461a818c4fde85c3543e74e5ca225953de1ff602870b2d3165c7d6f4ba024","observation_id":"308c911d-e79b-4961-ae02-36b73d28eb36","resolution":{"observed_at":"2026-08-05T10:59:58.567079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12091","last_updated":"2024-11-02T07:41:54Z","snapshot_observed_at":"2026-08-05T11:58:58.452278Z","submitted_at":"2023-12-19T12:12:18Z","title":"A Survey on Model-heterogeneous Federated Learning: Problems, Methods, and Prospects","version":2},"cited_work":{"arxiv_id":"2312.12091","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.12091","snapshot_observed_at":"2026-08-05T10:59:57.997107Z","title":"A Survey on Model-heterogeneous Federated Learning: Problems, Methods, and Prospects","venue":"cs.DC","work_id":"7c604404-426d-42d6-bbcb-c0efded32dbd","year":2023},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.297277Z"},"links":{"cited_paper":"/paper/2312.12091","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:14a33fcb11b42f92619e9c0d5bb213ff38faa600e483206d097cab5cdd38de30","observation_id":"ff20ec9b-7256-4624-8176-23ad8325b2fe","resolution":{"observed_at":"2026-08-05T10:59:58.065420Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03751","last_updated":"2023-02-07T20:56:21Z","snapshot_observed_at":"2026-08-03T12:30:04.066070Z","submitted_at":"2023-02-07T20:56:21Z","title":"Understanding Why ViT Trains Badly on Small Datasets: An Intuitive Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03751","snapshot_observed_at":"2026-08-05T10:59:57.055832Z","title":"Understanding why vit trains badly on small datasets: An intuitive perspective","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:57.055832Z"},"links":{"cited_paper":"/paper/2302.03751","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:d19021d8b04400b3901b4f8decd6f660450237770d13f753b98db2f586ba02e9","observation_id":"0158103e-9795-4759-885f-5fbc015ae4a9","resolution":{"observed_at":"2026-08-05T10:59:57.055832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:58.318908Z","title":"Zhong Long, Yuling Chen, Hui Dou, Yun Luo, Chaoyue Tan, and Yancheng Sun","venue":null,"work_id":"8cac632c-a64d-45b0-919f-5b776847b908","year":2023},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.579770Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:44a7bcde01bc46c26123f58298b5e90d533ae292602c0776501b7b4828886db3","observation_id":"ded39750-3699-413d-942e-3d6148f3e185","resolution":{"observed_at":"2026-08-05T10:59:58.409231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.08819","last_updated":"2017-08-23T16:06:20Z","snapshot_observed_at":"2026-07-06T05:52:59.445968Z","submitted_at":"2017-07-27T11:22:22Z","title":"A Downsampled Variant of ImageNet as an Alternative to the CIFAR datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.08819","snapshot_observed_at":"2026-08-05T10:59:56.235507Z","title":"A downsampled variant of imagenet as an alternative to the cifar datasets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.235507Z"},"links":{"cited_paper":"/paper/1707.08819","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:719526b8b0a7d9442202b5fc765a01872edee75d42bccf1eb092b25f4113aca1","observation_id":"69195c1a-e38f-43ff-8b31-9b081e54dad6","resolution":{"observed_at":"2026-08-05T10:59:56.235507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.02507","last_updated":"2022-08-04T07:37:07Z","snapshot_observed_at":"2026-07-06T13:38:40.554369Z","submitted_at":"2022-08-04T07:37:07Z","title":"ZeroFL: Efficient On-Device Training for Federated Learning with Local Sparsity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.02507","snapshot_observed_at":"2026-08-05T10:59:56.662419Z","title":"Zerofl: Efficient on-device training for federated learning with local sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.662419Z"},"links":{"cited_paper":"/paper/2208.02507","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:5ec9b9d2ba19d0e67d564ecf20eacec59a36559c7cb370187f1d8f8bd4dadef6","observation_id":"1424e056-fe05-4ebf-8095-88f9e974123e","resolution":{"observed_at":"2026-08-05T10:59:56.662419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T03:08:28.499865Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2509.03503."}