{"as_of":"2026-08-19T10:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee39fd2c3c44bdd14e405a46230c776c96a0d325147c4f3e879f60ed6b4b85fd","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:14:11.850502Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:35:57.972902Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-16T04:35:58.182125Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"cited_work":{"arxiv_id":"2504.20096","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.20096","snapshot_observed_at":"2026-08-16T04:35:58.182125Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","venue":"cs.LG","work_id":"5137fe4a-0342-48ed-82aa-17c8d06f27ff","year":2025},"citing_paper":{"arxiv_id":"2505.00982","last_updated":"2025-08-04T15:48:47Z","snapshot_observed_at":"2026-08-18T13:00:38.239741Z","submitted_at":"2025-05-02T04:02:36Z","title":"DHO$_2$: Accelerating Distributed Hybrid Order Optimization via Model Parallelism and ADMM","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:35:57.972902Z"},"links":{"cited_paper":"/paper/2504.20096","citing_paper":"/paper/2505.00982"},"observation_digest":"sha256:4799d1dc3f170a5d7f31308749a77926056b17bef58e3e8d01655a56ae54fa2d","observation_id":"5e6b71ba-4433-4fc9-9ab6-712b34b1295d","resolution":{"observed_at":"2026-08-16T04:35:58.186612Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.20096/citation-record","integrity":"/paper/2504.20096/integrity","json":"/paper/2504.20096/citation-record.json","paper":"/paper/2504.20096"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.334826Z","title":null,"venue":null,"work_id":"4a2a097c-393a-48be-9cec-688949a57ab6","year":2020},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.756142Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:8d1d347b64ff188a906c86f0e208d5b81b8b82b0f3d6c8f2b21c80af88a04ac6","observation_id":"e9a05c2c-a496-425a-8bf7-f8b80a30d826","resolution":{"observed_at":"2026-08-16T10:14:12.338057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21227/rz7n","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.095180Z","title":"A., & Johnson, C","venue":null,"work_id":"42b14b10-623a-403b-9681-898fe64b3206","year":2012},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.807795Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:c8b1d617cf983604388910a6e70054d8fac4bcd4ff3ec728706960bf1c9e64cc","observation_id":"c63504d3-00a6-4d3b-8688-35c578c1a4eb","resolution":{"observed_at":"2026-08-16T10:14:12.100355Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:11.821981Z","title":"(2001, 08)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.821981Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:7cba7254b09d8bc4d88aae3c9acd6f477bca99657f93a6d9b6735f4fc57bcc58","observation_id":"3ffdb0a1-9af7-4ca0-8827-a22facc1720e","resolution":{"observed_at":"2026-08-16T10:14:11.821981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.281973Z","title":"B., & LeCun, Y","venue":null,"work_id":"6cc2f723-38c1-405f-8c85-e2ec6631c84a","year":2015},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.782617Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:3d36a432d7a6604bc5755bb02e1b1e2da758ae1471983437e5bff77e7115b1df","observation_id":"11fd87f7-ecb2-4186-bb1e-ab0cdde108d1","resolution":{"observed_at":"2026-08-16T10:14:12.285426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:11.793680Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.793680Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:730e9e26ad2baa3f6a1eb58413bbe28061b7954f63d79b2eec2c2a3434577537","observation_id":"8375cf43-f2b8-4556-9b16-a097c5197789","resolution":{"observed_at":"2026-08-16T10:14:11.793680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02677","last_updated":"2018-04-30T21:53:41Z","snapshot_observed_at":"2026-08-09T05:23:26.365677Z","submitted_at":"2017-06-08T16:51:53Z","title":"Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02677","snapshot_observed_at":"2026-08-16T10:14:11.800801Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.800801Z"},"links":{"cited_paper":"/paper/1706.02677","citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:ce3aa7d0f690a9d49f962757a414cb1e138a8794eae6ea960f56c9d750e848a6","observation_id":"a97ee11e-805d-47db-9f55-c087f094178b","resolution":{"observed_at":"2026-08-16T10:14:11.800801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.254583Z","title":null,"venue":null,"work_id":"42cc9cfb-956c-40b6-a3a6-e2cf0c1c4498","year":2016},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.804628Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:889410180f9843f2bab3df552c5bea440fdf4227b05a76927711a0ebf9d7b6c5","observation_id":"1921bbe3-db85-4c09-aa2e-011f9532bb01","resolution":{"observed_at":"2026-08-16T10:14:12.258134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.243844Z","title":null,"venue":null,"work_id":"77851bda-acac-48a5-bf20-7e4899a90590","year":2020},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.811126Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:7395d66560ce49930f2ca674b901e3897c8cda321b82d8d886a6855c60ede8f5","observation_id":"e4bd7e1c-91b0-47d6-ad71-83eb98473554","resolution":{"observed_at":"2026-08-16T10:14:12.247275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-16T10:14:11.814394Z","title":"M., & Jordan, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.814394Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:d849386c1acf7935289f68d63b8a66005047887ced13e1ef937c1e7532c01a16","observation_id":"fc49d36e-ddd2-49e4-b7d2-feb86f26558a","resolution":{"observed_at":"2026-08-16T10:14:11.814394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.302426Z","title":"578–594)","venue":null,"work_id":"595fffcc-0617-4914-a597-4257238a543e","year":2024},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.774970Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:562424ecc183fb2b99f23fce62152778d2c9aa03b15151f624c34ee41faa8143","observation_id":"05b89b84-bcf4-4292-8a66-21cbe4141ab1","resolution":{"observed_at":"2026-08-16T10:14:12.306043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13586","last_updated":"2021-08-20T05:31:09Z","snapshot_observed_at":"2026-07-06T09:59:31.820485Z","submitted_at":"2020-09-28T19:07:02Z","title":"Apollo: An Adaptive Parameter-wise Diagonal Quasi-Newton Method for Nonconvex Stochastic Optimization","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13586","snapshot_observed_at":"2026-08-16T10:14:11.828573Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.828573Z"},"links":{"cited_paper":"/paper/2009.13586","citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:8895aeafd98404652c48c4fa1d69c7bb096c09fee81ad812f62696a06fda3cc9","observation_id":"09322ef1-6833-4cf9-adcc-942a01b62910","resolution":{"observed_at":"2026-08-16T10:14:11.828573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.06462","last_updated":"2015-03-19T06:54:53Z","snapshot_observed_at":"2026-08-14T22:55:44.275483Z","submitted_at":"2015-03-19T06:54:53Z","title":"Normalization: A Preprocessing Stage","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.06462","snapshot_observed_at":"2026-08-16T10:14:11.832441Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.832441Z"},"links":{"cited_paper":"/paper/1503.06462","citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:297dc914783535c969e3360f42d0816ce3ca3a90abe588f90c504e99ac82d97b","observation_id":"f29a9900-c887-4b86-a04d-194054c52bf0","resolution":{"observed_at":"2026-08-16T10:14:11.832441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00907","last_updated":"2019-04-03T19:54:50Z","snapshot_observed_at":"2026-08-17T03:03:30.016123Z","submitted_at":"2018-05-02T17:04:53Z","title":"Glow: Graph Lowering Compiler Techniques for Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00907","snapshot_observed_at":"2026-08-16T10:14:11.836058Z","title":"J., Kale, S., & Kumar, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.836058Z"},"links":{"cited_paper":"/paper/1805.00907","citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:32205327e8966b2ecc58a25afef8b0e96e1103c427d2826763cd2b6bd11dd783","observation_id":"f0704b5f-3215-487c-bedd-5d93dbf05548","resolution":{"observed_at":"2026-08-16T10:14:11.836058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:11.839600Z","title":"S., Gunasekar, S., & Srebro, N","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.839600Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:e02c5ad6b4c620b5bfd86c24af7fd364b3fdbd41a4902ae8561d16a1b2c2636b","observation_id":"a736e3c3-b44b-472c-a30d-2c5ea664b677","resolution":{"observed_at":"2026-08-16T10:14:11.839600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.212361Z","title":null,"venue":null,"work_id":"454ab8ec-2593-45d8-a814-f826c6d06fb9","year":2021},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.843105Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:b164c4e083e0386eff2b452584dae265a49bb06c11295f3b06880b58cd40cbb8","observation_id":"35267b79-32a4-45c3-ae60-da299e6db87b","resolution":{"observed_at":"2026-08-16T10:14:12.215850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.232655Z","title":null,"venue":null,"work_id":"5d5dcc0c-241e-48c4-80b8-fba2cff1972b","year":2019},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.818364Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:1ef36c76cae2641915107c599f1cc46aa98a93e4c7937a1c234593f193eb1225","observation_id":"55cb03a9-2936-48f5-a029-b740dc2acaee","resolution":{"observed_at":"2026-08-16T10:14:12.236379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.201912Z","title":null,"venue":null,"work_id":"6cb1bbab-9a9f-4868-9c4e-1c7547d54c76","year":2023},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.847275Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:9bae73dc0a6f5a8279067514b42fa5d52ad44691191904194253b2a55c0e5d6a","observation_id":"246afcd7-1fc8-4a68-88fb-6e75c8b2e8b1","resolution":{"observed_at":"2026-08-16T10:14:12.205199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:11.790182Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.790182Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:b74373e63cd9ac18ce432837f23b91b4167dbcd489a4d6ab3c1f12249814bae3","observation_id":"1d719f8a-4a3c-4cd6-8a6f-1a18407c87ee","resolution":{"observed_at":"2026-08-16T10:14:11.790182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.271491Z","title":"N., Pascanu, R., Gulcehre, C., Cho, K., Ganguli, S., & Bengio, Y","venue":null,"work_id":"6951420b-340a-430f-a138-5077ca8c258a","year":2014},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.786297Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:2734ead27834575284b42f5409a2de9897977eabcbcbcd80a578b36aba1ed665","observation_id":"cda69bea-cfbc-47be-80e1-cb00ac95417a","resolution":{"observed_at":"2026-08-16T10:14:12.275094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.222456Z","title":"E., & Makhzani, A","venue":null,"work_id":"55362417-a10a-4adf-9e90-eeba858d7921","year":2024},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.825195Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:3becbb128f09513212e68af60fa5f257a71552fd6fb7d226e0742b4d878a902d","observation_id":"1373d28b-67e9-475b-9df6-b34d7027b4d2","resolution":{"observed_at":"2026-08-16T10:14:12.226197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05871","last_updated":"2024-12-12T12:07:07Z","snapshot_observed_at":"2026-08-16T13:11:34.578456Z","submitted_at":"2024-10-08T09:58:38Z","title":"A second-order-like optimizer with adaptive gradient scaling for deep learning","version":2},"cited_work":{"arxiv_id":"2410.05871","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.05871","snapshot_observed_at":"2026-08-16T10:14:12.178831Z","title":"A second-order-like optimizer with adaptive gradient scaling for deep learning","venue":"cs.LG","work_id":"2c0b42e4-6dd2-48a6-ae3d-fd4f865df5b9","year":2024},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.764561Z"},"links":{"cited_paper":"/paper/2410.05871","citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:01941a062da8efbe00bfc204c868c3190048c247f0f089f74a38b9c3328de8eb","observation_id":"cb5e9ee9-2000-490a-82db-e71343a2aa12","resolution":{"observed_at":"2026-08-16T10:14:12.183526Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:11.797213Z","title":"(2021, February)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.797213Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:065a6dc935c9ebbeace8037b8b05964bb7e8e9176dc095d72d3a43c6f51bd862","observation_id":"365c5fb9-9db7-4514-8c56-495740b76619","resolution":{"observed_at":"2026-08-16T10:14:11.797213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.324188Z","title":null,"venue":null,"work_id":"4cbc8932-c793-4d3d-97d8-787c2522d7cb","year":2000},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.760296Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:bf77809118055b32183ca3e80d3670f6200a7bb4bf4b17165664f26f7c66f04d","observation_id":"f320229a-10ee-4446-9ceb-ae06ccacdb58","resolution":{"observed_at":"2026-08-16T10:14:12.327760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.190952Z","title":null,"venue":null,"work_id":"2366d7c1-f820-4bb8-a178-6c4cdc584edb","year":2024},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.850502Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:1bd59c2ce9cc4431b036d84265a2b9c47ff0dba343bcd81e902406098742a920","observation_id":"a4a6b763-6ffc-4c4c-8090-03170fd127ff","resolution":{"observed_at":"2026-08-16T10:14:12.194492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.292047Z","title":null,"venue":null,"work_id":"dce79d69-c88f-424f-90f4-31e2452eb6ab","year":2019},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.778739Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:b1b3633394e02cc57596c77eed0bb96fa4973b12ce42198bb8229fbb3ce1c0e3","observation_id":"bdc9b9b6-6e30-4a63-8989-2dc5b398ca08","resolution":{"observed_at":"2026-08-16T10:14:12.295610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:14:12.313556Z","title":"D., Dhariwal, P.,","venue":null,"work_id":"6cff9066-beb4-4682-b306-222165cb0d96","year":2020},"citing_paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis","version":1},"reference_index":450,"source":"pdf_text","source_observed_at":"2026-08-16T10:14:11.770112Z"},"links":{"citing_paper":"/paper/2504.20096"},"observation_digest":"sha256:35f27a01c56674cc26fa4c79b0afb1acc38c4e506fb60c5665f19ba201003d96","observation_id":"93c23b87-dbd6-415e-8b0c-e5f3e8ce7bff","resolution":{"observed_at":"2026-08-16T10:14:12.316973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.20096","last_updated":"2025-04-26T05:02:21Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T06:58:19.018432Z","submitted_at":"2025-04-26T05:02:21Z","title":"Towards Practical Second-Order Optimizers in Deep Learning: Insights from Fisher Information Analysis"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2504.20096."}