{"as_of":"2026-08-08T21:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:097712d680c1075a58646aab7ae94668905ffc195330da6defceebf453751564","coverage":[{"denominator":116,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T20:02:53.485837Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.07841/citation-record","integrity":"/paper/2606.07841/integrity","json":"/paper/2606.07841/citation-record.json","paper":"/paper/2606.07841"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"PosteriorDB.jl: A Julia package to work with posteriordb","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:bf41c86086b069124532cdfb1bc3b48433bd347703720aca707b6681920271df","observation_id":"7bb24314-9ba0-4b2b-ad05-3d3567a740ad","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":"1607.06450","doi":"10.1007/978-3-319-32025-0","metadata_source":"pith","pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Layer Normalization","venue":"stat.ML","work_id":"20a2d720-0046-4c7c-bcd6-327ec8143f69","year":2016},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:add08476c049b09320a787a792718ce73c7f50edf4f729a68742cd88e57cf428","observation_id":"d33599d9-0afd-425d-9e37-12a20202398f","resolution":{"observed_at":"2026-07-02T20:57:23.299060Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Online learning rate adaptation with hypergradient descent","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:3133616b44022fb1280f264b412749f418be92729d2f804dfec2728704fcc136","observation_id":"704cbe98-e985-463c-8b15-b44e0a5b16f9","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Training neural networks for and by interpolation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:3d9adc8ac731f5be2d91034e824688d53f82a6cb3ad58f413c18a8078f7e0c1d","observation_id":"67e7efc5-9862-4e6e-9b8d-af42f44d6b80","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Julia: A fresh approach to numerical computing","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:85a626baa8c965976b9e2850a04e61be389b55ec8e2f1759cfc0b968c5f8ae35","observation_id":"2067801d-6290-49a2-8a99-938c7c2579a9","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Variational inference: A review for statisticians","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:141ea7c682b23f87161d51177bbb5e3acd85b7b011d957b54a514f3b07d8a56c","observation_id":"b0247205-b239-4a7d-8e76-841f3d72046c","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"On-line learning and stochastic approximations","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:08effa1b660c4e8ad044ef8a51d503dc0034f8523941ba06c3ffbfe3d0577638","observation_id":"253c785a-6fed-4a95-8a30-d57aa4b82202","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Optimization methods for large-scale machine learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:cfd819d4bf99266e889156702e4acfe2a84b07db11afd1942bbfe847d86980bc","observation_id":"22f354b9-f2b8-44be-b659-47d9ae987384","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Quasi-Monte Carlo variational inference","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:31516c46bb22e8d42e091735f650b46af2f3e580dc8ab9a5fec0634ae72598ac","observation_id":"995a031c-28ac-4389-8cb5-8e43c56baa66","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Importance weighted autoencoders","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:3cfb6359624fce8d3b51dbbdfa29b5a9f474484f5d85c172afa8ebffba93f786","observation_id":"7ec904ee-8901-4fe4-9c3d-2f18820486e2","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Sample average approximation for black-box variational inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:e38745965b82fac410da94a06746b71150d284a1d8a4d89028049360fad317b0","observation_id":"3503c248-c47f-4a65-af44-df60f7277c0b","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"EigenVI: Score-based variational inference with orthogonal function expansions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:7026154fbf392b2aa4f3c6a91753a25bb87d941135cbeec8711198b2ea7cbbcd","observation_id":"c00a260c-e091-4d47-823d-dc5273101b85","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Batch and Match: Black-box variational inference with a score-based T. Campbell, J. H. Huggins, K. Kim, C. C. Margossian29 divergence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:912cc3625b8e7bc521909bbabf877dea2722693ad9177c01f716851e93d95354","observation_id":"7c784a13-ca55-47c6-8c9b-530257f59edc","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Making SGD parameter-free","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:debd2df5af1fe56c1db69f436b06c82219abbf7220421b826c5d5bc25472f9f8","observation_id":"860698ef-eb0b-437f-8634-3ade52995150","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Algorithms for computing the sample variance: Analysis and recommendations","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:21915f3860287f58c9764bbf05d48bf2058cec9479ed92b8fd3056092120d7de","observation_id":"f9a05077-a045-4047-93d4-ee159b2f6b84","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Symbolic discovery of optimization algorithms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:1dbe76537b81eece039eb18af71020ec5cac7510b9e1dee2f762e9553710c580","observation_id":"73b3e85b-7242-4b38-97b5-999e3d5e81be","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Mechanic: A learning rate tuner","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:34c90661d74a7e241a2fd5c09a9f0a89f12d400b450fcad09ac2266e8d6bee13","observation_id":"1619e1a6-8f55-4631-94e5-c608bf8759b1","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"The Helmholtz Machine","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:aeaed4df7e706199f45b61bae658d23129532528feb89eda59d322863805c149","observation_id":"0384c369-d3dc-4bf8-8daa-daa8c3efc47d","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Big Batch SGD: Auto- mated inference using adaptive batch sizes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:f7d6f283ce1ae2d09e9a2b6b22d4f0fb498b047f2a7a78e76de14f7db48ed5fc","observation_id":"00a8e820-a263-4a5c-9c46-ceb58609c0a6","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"SAGA: A fast incremental gradient method with support for non-strongly convex composite objectives","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:79858fb137f207c7a7f2c68bcc0f0cad13bbc2a602ee22b0bd7ee99273e04b08","observation_id":"198f2376-04a3-4cb4-8349-2f667d766af6","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Learning-rate-free learning by D- adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:fe3dbc32b8f2a15bc0c7cc429c5be8e2b8cab2fed1d0c834afcc7fc23a4f9587","observation_id":"ee18858d-75b7-4c07-a522-1f5f07f6653f","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Robust, accurate stochastic optimization for variational inference","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:89c4f0980b360504179154ea02d5be005bbd61206c1245cfe762dd55e60f185f","observation_id":"179f75d5-88db-4b61-a86b-28195185c4c3","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Challenges and opportunities in high-dimensional variational inference","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:5b6302ba79afec79431a9bdbf5fb8c88f299b9cabd04b269997ff10268932410","observation_id":"bb7201df-aaaa-4056-b593-901ebfe84669","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Forward- backward Gaussian variational inference via JKO in the Bures-Wasserstein space","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:4a05ff774d919ef64a7fd1f426e3132971ed8136d203a97708ecd7f35024d101","observation_id":"2f8a9a74-c97a-41f7-8e76-50c16fc32b37","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Variational 30Default optimizers for variational inference inference viaχ-upper bound minimization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:93fef63b3bf2efb0b5555b428ec49368c283e8e4efa733771cd9b379f7196c1f","observation_id":"0dce2761-e207-439c-9332-232101b4bb4f","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"bridging the gap between constant step size stochastic gradient descent and Markov chains","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:23e3b0315fa96e2cfb8d3eca29649f9f781b35c52d09feaf3287d7edbe66eea8","observation_id":"fd355b34-44f7-40d2-a1ce-3dd95bd32110","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Provable gradient variance guarantees for black-box variational inference","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:889be0a314dbb2a06d3eea3879504072f6e5013d95da785b1dd1419e00188f4b","observation_id":"e3477668-6e4f-4dac-8d91-b018c01a8750","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Provable smoothness guarantees for black-box variational inference","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:b119ad98c11642a841df0fbf500919ebc313865961ee12db593c9106eae432e6","observation_id":"b5c936cb-ca6e-4cb5-a8ba-13345e0058b4","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Provable convergence guarantees for black-box variational inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:c9a3649859ebbfb98a7207ad23eadc9c50402c7f4f7c05599d78ed8318a3b4c6","observation_id":"9c0a4aeb-cf12-4632-b96b-831afa2d1787","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Importance weighting and variational inference","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:c13d0f4337e6508a31a6be05fdfe3eb0f5eb762e81014f2feab1ae20bb8cee11","observation_id":"b98c08f7-5693-470c-a403-b8995c7dee1b","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Divide and Couple: using Monte Carlo variational objectives for posterior approximation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:44ebde68fc8d535c8031d5ffc2a31c9151c2601aab6f5a513e9b5606ac4c0606","observation_id":"20cc0a66-449f-424c-98f1-c2222d07a2b0","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Adaptive subgradient methods for online learning and stochastic optimization","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:4bb61046b2d269bedaf3bde0ce7e516a68e3bd05d6a24e9bf86494bceb853b9f","observation_id":"6fef75ce-d353-45b6-bf6e-772dcfe3aba2","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Batch means and spectral variance estimators in Markov chain Monte Carlo","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:4aae4c401f09bcab90e6993b61973b10c51ed0df5dd2acee59cef866715b35e4","observation_id":"aefc05df-b5ec-4972-a83f-3277ad36f83e","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Multilevel Monte Carlo variational inference","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:4bcc5651a7ecde51d3fe8b6bb7d43e027dd36600d91f168201d7e25d76b92dc6","observation_id":"7616c9d4-dde8-4ee0-a578-1bc068d05143","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Don’t be so monotone: Relax- ing stochastic line search in over-parametrized models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:89c13bd52464ea49a60b5aa165f875497bd5b1b947171589e190af2206a5fc13","observation_id":"55b9b324-665a-44d4-9f9e-301403323923","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Empirical evaluation of biased methods for alpha divergence minimization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:b40b41c344c34ffcd3a7160b6da74ce5466c7597b2e25788703414b83dcd3326","observation_id":"3d5be7d1-39f2-4b52-80b2-a08639cb5600","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"MCMC variational inference via uncorrected Hamiltonian annealing","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:911b8bcfbcb876f4b10b8187cb761bd433aa4ab31b01f4f820c7d2cf8c5ad62d","observation_id":"6e914b24-d866-4792-8ebf-9d6d4b992573","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"On the difficulty of unbiased alpha divergence minimization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:a9a342ef25664244b2d465f52f7ddddd13db767a4e13484322000af14d3e04b3","observation_id":"fcbb7a63-2fb1-496b-a3af-eb7b9364ce83","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Inference from iterative simulation using multiple sequences","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:78fc6fab8a6805701ee1977a1023210ea49740afc633ba22324a49b8e7bf0323","observation_id":"db08ba97-85b7-4cda-ae49-64e1825b1e04","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Black box variational inference with a deterministic objective: Faster, more accurate, and even more black box","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:344fa4fa8170a45dffa4234881d08b54c0a0fa92371580cf9a96bd4e5d708f5f","observation_id":"6b38a50b-406f-42a5-997d-6f85a40c2cc1","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Practical variational inference for neural networks","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:582f2f9b8c9f4812f56839018456f56346e1959ca572edbf31dd840850065ee7","observation_id":"c7c3de64-1948-4e52-ab6c-d125b1d4a9c4","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Shampoo: Preconditioned stochastic tensor optimization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:6b718cf5999346fd97556394ad32c3fa51973435d1df086170bb5759423332e7","observation_id":"5dc5f5ba-fb9c-4c6d-b832-76802ddbb3f5","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00313","last_updated":"2022-08-02T17:48:25Z","snapshot_observed_at":"2026-07-06T07:49:44.506891Z","submitted_at":"2019-05-01T13:47:40Z","title":"Revisiting the Polyak step size","version":2},"cited_work":{"arxiv_id":"1905.00313","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1905.00313","snapshot_observed_at":"2026-07-04T06:59:37.573960Z","title":"Hazan and S","venue":null,"work_id":"1fafe5d3-69fe-46c5-b51a-9dfe1038d907","year":1905},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"cited_paper":"/paper/1905.00313","citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:727424374a45d6894283e66fb67dccf7a946553ce3d9bc30fee58bd2c3bcaf13","observation_id":"55cc2e41-8829-4821-a7d7-c4d5910f1f3f","resolution":{"observed_at":"2026-07-02T20:57:23.296734Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:7a276bbb8df8e32329e79429959ff0071676549f0b3721288ca55e59bdc356a6","observation_id":"b3a0f799-1512-4fd7-b79f-19a6e8aa0640","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Black-Box alpha divergence minimization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:add0be0e028978f3f085746f0f942ca99cda1fa26bb92232082d4658b2748d62","observation_id":"02e4076e-e458-4f57-a0d4-de20101b699c","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Keeping the neural networks simple by minimizing the description length of the weights","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:67a7f9ed4a86f012e47fa27409a10ae12eb9ca93564484ed150df3adf06dffa9","observation_id":"915410b9-4063-4cbc-9974-bc736a585d1d","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Perturbation analysis and optimization of queueing networks","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:f0a9b56a0e25c031bbc5667673ca3134803f2b57edc4f0bcf33b3a714827b06a","observation_id":"9d46ff2e-3ff2-44f5-96a8-5b3874ceab05","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Validated variational inference via practical posterior error bounds","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:ff66bde128019cb16b39902f4361d78f557b7994c2bea9ddb141334417fc057a","observation_id":"20ce6e99-4c80-4ff3-b772-3c2c8dfc8155","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08235","last_updated":"2017-02-27T11:16:54Z","snapshot_observed_at":"2026-08-02T07:17:14.537608Z","submitted_at":"2017-02-27T11:16:54Z","title":"Variational Inference using Implicit Distributions","version":1},"cited_work":{"arxiv_id":"1702.08235","doi":null,"metadata_source":"pith","pith_arxiv_id":"1702.08235","snapshot_observed_at":"2026-07-02T20:57:23.300337Z","title":"Variational Inference using Implicit Distributions","venue":"stat.ML","work_id":"0c346fa0-b90f-412a-99f7-805a463a1d5f","year":2017},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"cited_paper":"/paper/1702.08235","citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:a974b54d4906f7c3a4f0d119632a19c2f0b68027b7a845c88bda6957e3efd4dc","observation_id":"e55a1678-db42-4848-9f0e-5f082cc584b8","resolution":{"observed_at":"2026-07-02T20:57:23.301455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"DoG is SGD’s best friend: A parameter-free dynamic step size schedule","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:7d089812e2bf724e8c44f10f286929fd21161dbde2608ebd01eeca294f9948b7","observation_id":"fc9f941d-b59d-4bab-a51e-56cd17ad9856","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Accelerating stochastic gradient descent using predictive variance reduction","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:a750bd8e1fd84f1ad270d5f19869ff146c3c4c4b638d4828eba1916dfe07b107","observation_id":"112f47fc-63d7-4d45-b33c-0aa21d3ed220","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Muon: An optimizer for hidden layers in neural networks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:b5e7eec421618283af4c50f0a2b661aa6ba31d91ee341ec0dfaec58a6808294d","observation_id":"e03c0fe8-b8df-4912-893a-d7bba84ef00d","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"An introduction to variational methods for graphical models","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:baa24d86b447d8d3512da08438eade6f7084078cddec60e5e37af7ef539eb85b","observation_id":"e464c5e2-ec83-487d-ae8c-d9fa72f6abfb","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"DoWG unleashed: An effi- cient universal parameter-free gradient descent method","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:b48ab22d1f658294e2882945123868de54709829aebd8569648a25aa05f4356a","observation_id":"e658d7f6-ec94-4703-8652-1e227aa5c8bc","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"The Bayesian learning rule","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:ad3d78b522eab104471dc8907007c829e03c18249ad8be1e4b8b37dc8e027812","observation_id":"a0408f92-a13e-4252-8250-d7cde2b988a4","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Linear convergence of black- box variational inference: Should we stick the landing?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:90e0de499e4573c9661ded5e9c93607646a313f43f38ec1e61622c2f1fa68506","observation_id":"ff3fd9e8-f75f-4466-aff2-1f8a89cec362","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"On the convergence of black-box variational inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:5b4d081271c295bec81afc2c9ab858f209c2327217b47e12066da743d5878ce2","observation_id":"d0d4f03f-650f-47dc-8b1d-844613acab5b","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"A guide to sample average approximation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:170d22568021a582027b3c2aadb5a3608e39807aeca63692fc066b0bc0f3f0b9","observation_id":"2ca9014b-8603-48cd-bd44-52bafc186920","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:d015066412362133f584089749fab28684d8231ddbc43a5f2f11721443d3493b","observation_id":"d073021d-2fce-4289-ab8a-b00946255548","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Auto-encoding variational Bayes","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:1f823ec9e3c9715ce51e8dd0a917ee168b772aa5ab17166471e8ac51f91ee177","observation_id":"de32b6ba-e932-46d6-b56e-06b976dfb0fe","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Automatic differentiation variational inference","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:666043133a14152906cba42877e2a95a53436b43b03e6e318eb1077143e512a4","observation_id":"e448df27-46d1-4016-b296-3436af9c4b79","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Optimization guarantees for square-root natural-gradient variational inference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:af64a9a570a7eedd1e800dc305509997ad5ab41ffa147f688924c65da8642bb4","observation_id":"812a9dc2-7814-4d6a-9d95-9b8041c98d52","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Varia- tional inference via Wasserstein gradient flows","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:daa3aae4e815bec44c7c18329ae6037f4707ace0e728e9868b06ecfb2dadd41b","observation_id":"8de5267f-eeba-4f0a-8b21-c4584ec9c01f","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"A stochastic gradient method with an exponential convergence rate for finite training sets","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:cd3c061d1286b74c3e1eb6a497e4d9efb0b5cab261ebf0d74aa1eae15f0c60f4","observation_id":"ec24212e-de98-483a-88f1-67cf13047bb5","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Rényi divergence variational inference","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:cce8bd2c69891d8202c39d4bd7c13f21a6e674dcd567898c4141fa9489949ce6","observation_id":"bc280f19-b8ae-4ece-9770-89bb516e28a1","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Fast and simple natural-gradient variational inference with mixture of exponential-family approximations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:4672f9a915fe4445a5f046f176c27d6d51a432eaa0503936a53b359fae9c78b6","observation_id":"604feac3-820b-4af3-8e6b-522faa349a13","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Batch size selection for variance estimators in MCMC","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:317c26fea5298444a0cacc2b05263a75f7cebdb428bad7662f456d1d7f2d4a51","observation_id":"0c45f499-7ee1-4cc2-9b21-59d0a3a3a38d","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Stochastic Polyak step-size for SGD: An adaptive learning rate for fast convergence","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:47d665418f8891fde8b70802b9694700a630d050d0b143e8cb4748e9ad7e343b","observation_id":"fe208f39-5796-4f21-84f7-afc649c9f617","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"The power of interpolation: Un- derstanding the effectiveness of SGD in modern over-parametrized learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:ad4bc72ff970fa824da38ff8991d56e7a16ee3f28d78267a6b9f5c66661df8c4","observation_id":"f335ad2d-db64-487f-a30d-169a8d4f4469","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"posteriordb: Testing, benchmarking and developing Bayesian inference algorithms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:a94b519c9bf2e08d5ed5cc1ebc9da6828ada21cb700da530a77e7242da6ae50e","observation_id":"602a4f83-bb57-41d6-b2c7-7e2e20b64fb4","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Torsten: A platform for Bayesian inference of pharmacometric models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:c5b3fe5ade3376ddc96cc959cd5910ba12a3e2211eae5884a0d03b1ba4212e4b","observation_id":"3e5bf85a-9aca-4492-9131-b35566fc83cf","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Expectation propagation for approximate Bayesian inference","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:5e34b80f98bde1eb442f6e6e8fc9b24660bf5703504d47847f2bc937165b1610","observation_id":"dcede6ab-3b70-4d7e-8571-25ccc707f8e4","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Variational Inference with Gaussian Score Matching","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:c0fa59600155286ad76a8140db4e66556e8fda0b0ed29a0d9f176f9125b0f4b7","observation_id":"9a888c9c-2ecd-4bbb-a2e9-116d3cf1f1fe","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Monte Carlo Gradient Estimation in Machine Learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:69ee1b2a6d3182667a0460ac0217c3bb389e6468eb44826086c4248b8cf1254f","observation_id":"7a1091ce-1e5e-48c5-a57d-35aec4fa87f6","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Instead of Rewriting Foreign Code for Machine Learning, Automatically Synthesize Fast Gradients","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:425053cd6ed9b00210e9f36a7b5dbe2d077e8745bce76252af6b49e2fed6e091","observation_id":"fba658eb-54c1-42ed-b0f4-9e1a217ad2e1","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Rectified linear units improve restricted Boltz- mann machines","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:8bd4696e862f8350ce2feb0ff5caa74903e2c7f3de3e472a037ed21b65d2badf","observation_id":"ebc400fb-0391-470a-a6b1-ed24aff6e6b3","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Gaussian Variational Approximation with a Factor Covariance Structure","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:d48ca21a5b4fd228aee7123aa59e6c66c1a76204260b8c12970f91734a0ae5f6","observation_id":"b2d1b7b0-e139-4d94-b4bf-7f117b984faf","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.00236","last_updated":"2021-01-30T15:05:34Z","snapshot_observed_at":"2026-08-08T06:50:13.797921Z","submitted_at":"2021-01-30T15:05:34Z","title":"Parameter-free Stochastic Optimization of Variationally Coherent Functions","version":1},"cited_work":{"arxiv_id":"2102.00236","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2102.00236","snapshot_observed_at":"2026-07-04T16:29:56.943866Z","title":"arXiv preprint arXiv:2102.00236 , year=","venue":null,"work_id":"76512e50-b571-4c65-a26c-171bca1d3390","year":2021},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"cited_paper":"/paper/2102.00236","citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:48d0ee1c6778891402449390a9385a37f978e2885ed4c971545cdba2e25b144a","observation_id":"1f4cf38e-df62-4d2f-86e7-184c0ac2b018","resolution":{"observed_at":"2026-07-02T20:57:23.291452Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Training deep networks without learning 34Default optimizers for variational inference rates through coin betting","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:37fa85960f45176c475d981a5b03021456a90f4faeca631cea6d278296b767e8","observation_id":"81892e46-64cf-4c22-bb79-fe02ba15cc2d","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"R package","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:0dd25379af17c53023dbe31f9e92179624853e031184de8f577b65214ea30310","observation_id":"45dd343e-9213-4979-a419-375b36d73512","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Explorations of the mean field theory learning algorithm","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:db5d46616a429111450b82d78653f27cc415afb84ef7ca04e3b207ee0b366d48","observation_id":"28e31af2-badb-4cc1-a5d6-1282fb99765f","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"On the determination of the step size in stochastic quasigradient methods","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:6a982bc87d4ed28a26522c1730a43caff6795180c8735ab690f3b0db6fef53ef","observation_id":"33d12e04-df72-47af-b23d-9f87c7e6c2c0","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Acceleration of stochastic approximation by averaging","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:d96fdf49ea7347e8d50d075c5189a9c03f3ee372885fd7e8efcc82cc42341256","observation_id":"624c7bd8-4b9b-4c04-8438-3939538c1964","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Blackboxvariationalinference","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:5d54caa66fe7a9cdbb1793ce1a741d8ba8592934afd2fa98c538adac75887c00","observation_id":"3c45809e-4f90-4658-8919-4f8b68cfd979","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Hierarchical variational models","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:99151949f6f51b3091f0dd99909c6a846b9b0d358070079aa4e7e902b2805d03","observation_id":"a1dcc534-197e-4a50-b39f-febd2c88e52a","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"On the convergence of Adam and beyond","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:5e7664ac4507b37a50c22903311a9aa31087b16dcd7a67c7eb2550ebc7fcfad4","observation_id":"e8e965bd-7b75-45dc-b568-01202d32aacf","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Variational Inference with Normalizing Flows","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:783df6209dc13360bf1aca28f80a7d76637dba676d901230e7e80287eab31f23","observation_id":"427c0462-5c5a-4a53-8a42-13da741a1d6b","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Stochastic Backpropaga- tion and Approximate Inference in Deep Generative Models","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:78c9fa3458d633d11515c3e8683eb80ebb6b95ab2689e352b7faac3acfd2fbc8","observation_id":"43ac5cd0-a71a-4fdd-a87f-6c3c07fea050","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"A stochastic approximation method","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:1f6a7ae6306b2e4ca9329191c5fc6c00f6d11343bc0c46caf2075f5f233ac82d","observation_id":"06b391e6-d3df-4f0d-b845-38f63c27bf6d","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:cc94cce6eff58561507522361c3af9e6f64e9c9e58c133be755cc9527aaa97bc","observation_id":"01dbe5a4-8ca9-4e17-aaa7-714d7ec84ea2","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Sticking the landing: Simple, lower-variance gradient estimators for variational inference","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:c43cf13266d3b9d7140d4d5ab5b04d6837cf3ccaf927ea1bddc993885f3d76c5","observation_id":"64ce123a-e0d0-4cfe-99f6-fba6753e9725","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"BridgeStan: Efficient in-memory access to the methods of a Stan model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:bdd834434c1f13ba44ef5a6331ef8ba6e01bf04a176d67d1d40b429bec8e80ce","observation_id":"7aa1f528-8d85-4ad1-ab56-988d3afd7a31","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Sensitivity analysis of discrete event systems by the “push out","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:cbdc8c359de251b9025bfc2c8cbbed950ffa764d01893ddd893ff7d97cc223c1","observation_id":"f41e12c4-c650-4a9a-a6f1-49a3b2083cfc","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Markov Chain Monte Carlo and Variational Inference: Bridging the Gap","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:7ddd63e7d846b2c5cd9d1381ce517eb937eb93b9091984c57611e23b0cd963b1","observation_id":"23558ea4-ab0b-42a9-99de-73d2686a4eea","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Mean field theory for sigmoid belief networks","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:546321ba98a475671cbfcebc6124d08a6b513f13c5e4b657d500107f6c06b3d9","observation_id":"2f9b09e3-1626-44e0-b833-0af4e284d37d","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Descending through a crowded valley—Benchmarking deep learning optimizers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:cc1aeebbde69e6db58f2fcb791eb2992279c38530742e253ec5f905b3e80c4a2","observation_id":"4558e435-290d-41fc-8794-a428bbda8b92","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Stan Reference Manual, v2.38","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:bd7d85d365ccd97257c315e56d339881765e7d85714d34a59a49169808415b8b","observation_id":"9d3052d3-5fe5-4a67-9168-2b039638c3ce","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Analytic natural gradient updates for Cholesky factor in Gaussian variational approximation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:6e976c2304e2653780b4dfbce547871fbe8cfcee95b13ee644274d909ff3778e","observation_id":"da64207c-2f92-4471-9c7e-c8400a643176","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Gaussian variational approximation with sparse precision matrices","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:d875bac551d602c98a36728f2ae083d1b5ede64723b5f3e774be29c20910aba2","observation_id":"028277a5-a7c3-46ff-a8cd-6e518e81fd19","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:02:53.485837Z","title":"Doubly stochastic variational Bayes for non-conjugate inference","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:53.485837Z"},"links":{"citing_paper":"/paper/2606.07841"},"observation_digest":"sha256:e9dc554e6f154c782244c85cf305167d5612a7f46b8fbff640f0f73068a45dd0","observation_id":"1bee595d-ade2-41ad-be0b-376bf0a80434","resolution":{"observed_at":"2026-06-27T20:02:53.485837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.07841","last_updated":"2026-06-05T21:04:12Z","latest_version":1,"primary_category":"stat.CO","snapshot_observed_at":"2026-08-06T11:32:52.174083Z","submitted_at":"2026-06-05T21:04:12Z","title":"Large-scale empirical tuning and comparison of default optimizers for variational inference"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":96,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":116},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 116 outbound references and 0 inbound Pith citation observations for arXiv:2606.07841."}