{"as_of":"2026-08-16T15:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db684746a1e67928488a796ae751c09d72c6fe5c01c00350e8b818eb882cad5e","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:42:46.521336Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T01:44:04.922621Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T01:46:13.900102Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"cited_work":{"arxiv_id":"2505.00793","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00793","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kemaev, D","venue":null,"work_id":"413d9d1e-e60f-4fd1-b6d9-f564ecc5af09","year":2025},"citing_paper":{"arxiv_id":"2605.08144","last_updated":"2026-05-02T19:43:16Z","snapshot_observed_at":"2026-08-13T14:04:31.314668Z","submitted_at":"2026-05-02T19:43:16Z","title":"NoiseRater: Meta-Learned Noise Valuation for Diffusion Model Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T01:44:04.922621Z"},"links":{"cited_paper":"/paper/2505.00793","citing_paper":"/paper/2605.08144"},"observation_digest":"sha256:32c0ce6684e1fe7440cb1c18e7bb7afe08dcbb028bdcd96138d0127d82a37531","observation_id":"3f4feebd-adb4-4f1a-ad23-da235d518396","resolution":{"observed_at":"2026-05-12T01:46:13.901640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.00793/citation-record","integrity":"/paper/2505.00793/integrity","json":"/paper/2505.00793/citation-record.json","paper":"/paper/2505.00793"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.039200Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.039200Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:3d414ae82c180cbaee7faadf0044ecb36e25f64c766f3f2c305ac2c2c84f20ce","observation_id":"32a2c673-c91a-42ba-b941-5bcd33f123f6","resolution":{"observed_at":"2026-08-16T04:42:46.039200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.12284","last_updated":"2020-08-28T03:48:50Z","snapshot_observed_at":"2026-08-13T02:50:10.164953Z","submitted_at":"2020-08-27T17:41:34Z","title":"learn2learn: A Library for Meta-Learning Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.12284","snapshot_observed_at":"2026-08-16T04:42:46.052178Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.052178Z"},"links":{"cited_paper":"/paper/2008.12284","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:68ea7b7d5b732b2fa78f9bf2e792acf3e6ff00c1a86adc61c520d454514be6b4","observation_id":"1b0af867-4c46-4d59-8094-7b8fa235dea2","resolution":{"observed_at":"2026-08-16T04:42:46.052178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.059596Z","title":"and Strassen, V","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.059596Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:1c0664d3910df7cd18573066c78ed204e0c264821a72c8541247d65f00e731b7","observation_id":"0c457a44-be13-44d9-bb2e-c30c5f85f63c","resolution":{"observed_at":"2026-08-16T04:42:46.059596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.069048Z","title":"T., Duvenaud, D., and Jacobsen, J.-H","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.069048Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:71e9668319cfbff749652dbf3949d25897174cd2e18027ccb1ccf29f48c9ff42","observation_id":"c86f817b-20ec-40a4-afba-34207a6f8f2e","resolution":{"observed_at":"2026-08-16T04:42:46.069048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.740232Z","title":"Gradient-based optimization of hyperparameters","venue":null,"work_id":"491cf4fe-784e-4ebb-b938-58fd0da2a808","year":1900},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.077220Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:e65f365c9574f9646da82cbe1cda5cc6765c121218c78bec37b8beb1cf8a08cd","observation_id":"9a1dc263-0c9c-4810-a649-5480a7221048","resolution":{"observed_at":"2026-08-16T04:42:48.750985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14606","last_updated":"2026-08-03T02:53:27Z","snapshot_observed_at":"2026-08-16T14:07:35.095735Z","submitted_at":"2024-03-21T17:55:16Z","title":"The Elements of Differentiable Programming","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14606","snapshot_observed_at":"2026-08-16T04:42:46.086085Z","title":"and Roulet, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.086085Z"},"links":{"cited_paper":"/paper/2403.14606","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:0fb91e1865492ccbd0c8162a70551478c15794cc0f32f188ea3a57f1cdab4af5","observation_id":"eb644eeb-b30d-4845-a30b-0a853e20f6d5","resolution":{"observed_at":"2026-08-16T04:42:46.086085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.709797Z","title":"Efficient and modular implicit differentiation","venue":null,"work_id":"918713ef-c8da-434b-8e2c-4aa4dd41ab03","year":2022},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.094907Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:ed81b62201b33121ba1577d248dbed22ced6825152c0cf1df67a616d8bec86fa","observation_id":"99f3b6ef-7281-4c4f-acdf-9c3b08e0c058","resolution":{"observed_at":"2026-08-16T04:42:48.720788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.104249Z","title":"J., Leary, C., Maclaurin, D., Necula, G., Paszke, A., Vander P las, J., Wanderman- M ilne, S., and Zhang, Q","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.104249Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:2abf0871a361b69c29a896c57e034b9553c269df7dc35616b8f75113bb0ae6b5","observation_id":"a04cc25f-2945-4da4-95ac-049f6a98ef11","resolution":{"observed_at":"2026-08-16T04:42:46.104249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.110967Z","title":"A., Farquhar, G., Kemaev, I., Zintgraf, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.110967Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:9c0a55848e8e534fc8410bd9f37403bb374567b778dfb7df5c5d1ab08b96a6c4","observation_id":"a5a6d614-2ceb-4b3f-85c8-e29282d16ef9","resolution":{"observed_at":"2026-08-16T04:42:46.110967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.363504Z","title":"V., Ahn, H., Neiswanger, W., Xie, P., Strubell, E., and Xing, E","venue":null,"work_id":"4fb51457-aa80-47df-8f6b-5d9a62d36bc0","year":2023},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.117468Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:984e384e202968eab0e3d6eb500d914dbfacc7051b65381f0b0d053b85c35425","observation_id":"9d24c88e-ca1f-4d01-aaf3-328d331c2f71","resolution":{"observed_at":"2026-08-16T04:42:48.370238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.337817Z","title":"How to compute hessian-vector products? In ICLR Blogposts 2024, 2024","venue":null,"work_id":"a2d758aa-49a6-46e2-94e3-d8b68871fd2c","year":2024},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.123588Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:281b1df9f713e008191f5f86cfdda104a1d00a6c739a3966c08bbbb33f9b8312","observation_id":"c9b70329-e3b7-416c-90be-2919b3f3ecde","resolution":{"observed_at":"2026-08-16T04:42:48.345433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.313234Z","title":"The D eep M ind JAX E cosystem, 2020","venue":null,"work_id":"7c017252-5469-41d9-9705-1d8de34c0957","year":2020},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.130503Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:b62bcd6eef9902bf455b95ed2fe812d6dbd519a9b42f4568ad474dfc315e7575","observation_id":"33c498e0-a619-425b-8918-2af5e2bc3a89","resolution":{"observed_at":"2026-08-16T04:42:48.321299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.283205Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks","venue":null,"work_id":"fe49542f-6b32-465a-a871-0e39585997c8","year":2017},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.135880Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:b6d70568a09dace5c4397f2c0931a9864ba3f1536c2fd024d27b4e206f26b3b8","observation_id":"750f8ded-fa03-4428-8807-73bb182f249d","resolution":{"observed_at":"2026-08-16T04:42:48.291276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.257584Z","title":"Forward and reverse gradient-based hyperparameter optimization","venue":null,"work_id":"607acc57-3ae1-4ab5-83b6-4562bbfefb2b","year":2017},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.141681Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:ea0406b27e107d8a8383dabaa2560f36d4d7d9fe3a9854c59d9ae396541305ce","observation_id":"18e030a2-982e-4052-adcd-c53edeeba71c","resolution":{"observed_at":"2026-08-16T04:42:48.264751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.148398Z","title":"Bilevel programming for hyperparameter optimization and meta-learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.148398Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:30d100d02f59c8aad13e320805a3d67eb3e23b375a32547ca028a16a6b319b2d","observation_id":"d0378642-acbf-4b8d-9533-be99a642943f","resolution":{"observed_at":"2026-08-16T04:42:46.148398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-16T04:42:46.154744Z","title":"M., Hauth, A., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.154744Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:3563280ace5fcbe7288e2484b47b4770f5564219e1a2fdfdde97147c801825b9","observation_id":"f3118e49-7cbf-4156-a2ac-e66792cdfef7","resolution":{"observed_at":"2026-08-16T04:42:46.154744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.199284Z","title":"Achieving logarithmic growth of temporal and spatial complexity in reverse automatic differentiation","venue":null,"work_id":"fa94fb3e-0eeb-44de-9483-0d3f6475a60b","year":1992},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.160936Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:e0c13801457c04995ad9eb387f7fe1a163a6210e4bbdc7ebe337547f2a4070eb","observation_id":"1c97ff8b-4c95-4071-895c-3af88c6975a5","resolution":{"observed_at":"2026-08-16T04:42:48.209141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.157039Z","title":"and Walther, A","venue":null,"work_id":"4b7d2dec-0b9d-4688-84da-2445a887bced","year":2000},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.175422Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:4b13cedbd95a1750045caf9f68e0594b0985842b69a67f04a4afc70a12398682","observation_id":"bbcb2893-a2ce-4675-9de3-b03da7731c8e","resolution":{"observed_at":"2026-08-16T04:42:48.165912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.186814Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.186814Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:22e12aed372438e536f95d59c06287092bae6e0edc86f623fb0d627723fe1deb","observation_id":"4153e7de-16d0-4421-bab0-5d0d044314e0","resolution":{"observed_at":"2026-08-16T04:42:46.186814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-16T04:42:46.200998Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.200998Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:d998d3859fad7a9a09900217370c4e8e265768f3f009e51046a33e0aa8eb690b","observation_id":"ed01eb73-eef7-48c8-b0b4-539e2231b3c9","resolution":{"observed_at":"2026-08-16T04:42:46.200998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.099804Z","title":"Meta-learning online adaptation of language models","venue":null,"work_id":"957d62a0-4c3b-4deb-b5d2-762dbe2f61c2","year":2023},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.209276Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:e7df44bedec377c4f790f81124cf20cb6a9a30ff2035bb83fda9c287c060a75f","observation_id":"d5cd417f-ec9b-4c0e-98e6-2cfac7bab40c","resolution":{"observed_at":"2026-08-16T04:42:48.108188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15076","last_updated":"2023-10-20T22:49:24Z","snapshot_observed_at":"2026-08-16T15:30:11.545662Z","submitted_at":"2023-05-24T11:56:20Z","title":"Meta-Learning Online Adaptation of Language Models","version":2},"cited_work":{"arxiv_id":"2305.15076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.15076","snapshot_observed_at":"2026-08-16T04:42:47.108936Z","title":"Meta-Learning Online Adaptation of Language Models","venue":"cs.CL","work_id":"b1889ee9-37e1-4630-9a2d-4ac0d5be2cc2","year":2023},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.220157Z"},"links":{"cited_paper":"/paper/2305.15076","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:223fff722475ae75726d1d0d768f7af1c324fd0087d99ecd276a007b86d138ac","observation_id":"637d98af-f40c-4fdc-812f-f263d0ddbc0a","resolution":{"observed_at":"2026-08-16T04:42:47.125984Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-16T04:42:46.233274Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.233274Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:e3d8b6a0a8344927d2370d898b2cf95f596e067ad9119b36af6c2899f47a5f86","observation_id":"bd8778ad-741d-43b9-a015-2c22a2a6e798","resolution":{"observed_at":"2026-08-16T04:42:46.233274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-16T04:42:46.242647Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.242647Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:58c9207c58ea7cc903db9391ebbbacf2640f44590cefb489968927942defe4f5","observation_id":"8ec669e9-fd52-4421-b7d0-675530059fe9","resolution":{"observed_at":"2026-08-16T04:42:46.242647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04451","last_updated":"2020-02-18T16:01:18Z","snapshot_observed_at":"2026-07-06T08:50:12.690900Z","submitted_at":"2020-01-13T18:38:28Z","title":"Reformer: The Efficient Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.04451","snapshot_observed_at":"2026-08-16T04:42:46.258570Z","title":"Reformer: The efficient transformer","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.258570Z"},"links":{"cited_paper":"/paper/2001.04451","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:8af79f866798752e308c119470a0eea9fefc7fb9a9e557de24fe7142a523aaa3","observation_id":"faec434d-0009-42e7-92b8-a7155937a654","resolution":{"observed_at":"2026-08-16T04:42:46.258570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.09055","last_updated":"2019-04-23T06:29:32Z","snapshot_observed_at":"2026-08-15T06:40:14.261008Z","submitted_at":"2018-06-24T00:06:13Z","title":"DARTS: Differentiable Architecture Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.09055","snapshot_observed_at":"2026-08-16T04:42:46.270296Z","title":"Darts: Differentiable architecture search","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.270296Z"},"links":{"cited_paper":"/paper/1806.09055","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:a27b28df2120bd67bc8f47c1ab83c678aba3e5e51a49ea0bc78c35217f2f1555","observation_id":"5e20f077-0489-4749-8d11-d7f33f901415","resolution":{"observed_at":"2026-08-16T04:42:46.270296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.278838Z","title":"Investigating bi-level optimization for learning and vision from a unified perspective: A survey and beyond","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.278838Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:13a93a71adf6813e2df820186adabcf1e08723cadbb77e50fd0a17a6fe126eb0","observation_id":"b26e9967-23de-4727-91d5-068979dd9116","resolution":{"observed_at":"2026-08-16T04:42:46.278838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.294786Z","title":"Optimizing millions of hyperparameters by implicit differentiation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.294786Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:219af4773adf7634d9f3237e1a4bba569753d28ef6ca1ae305cf0490e91d77f3","observation_id":"09b51aa0-acd2-4aa3-9ec3-972e131746d6","resolution":{"observed_at":"2026-08-16T04:42:46.294786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:48.022178Z","title":"Gradient-based hyperparameter optimization through reversible learning","venue":null,"work_id":"4241a799-5fc3-4eba-8672-7efadf7ccad5","year":2015},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.302706Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:e76f64d352196f7b80e727d34d7f370449582ab77c339a8d27d4dec665e1e8bf","observation_id":"92b4d503-d681-4eb8-bccb-beea3a9d741f","resolution":{"observed_at":"2026-08-16T04:42:48.030246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.312569Z","title":"Reversible vision transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.312569Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:d1db1d88e5196c46c27541b4799fa30dde7b25fac4b337b31f37837e344fa4a4","observation_id":"cf6e7e08-360e-4442-b3d4-c7c0bfdf7957","resolution":{"observed_at":"2026-08-16T04:42:46.312569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:47.968171Z","title":"D., Harrison, J., Maheswaranathan, N., and Sohl-Dickstein, J","venue":null,"work_id":"390be29b-612c-486b-81dc-688837c757a2","year":2022},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.323913Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:45af633362b0b2d5b04359958537a48747e74180617700af1ed32286d6e56f1f","observation_id":"ae9f2b35-d6d3-4863-8693-4dac9aca229e","resolution":{"observed_at":"2026-08-16T04:42:47.976777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:47.935747Z","title":"M., Xu, Z., van Hasselt, H","venue":null,"work_id":"46a093e6-2715-4a0f-bcaa-63786ecf6b25","year":2020},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.332247Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:92db0c66b2646eaef8017d0ff92e3cbeaebba61e42fbe47e2aec94fb262e8a8d","observation_id":"5d8a4a98-8dfb-4acd-bedb-2d8098b08bfe","resolution":{"observed_at":"2026-08-16T04:42:47.946958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T04:42:46.340154Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.340154Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:347b405c1ae8a29743f5bf3349a28afc103b4f221f0ec593c2f6e895496f211d","observation_id":"a1fd4e0d-9978-4370-807a-8b8c9465a3dc","resolution":{"observed_at":"2026-08-16T04:42:46.340154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:47.900847Z","title":"Automatic differentiation in pytorch","venue":null,"work_id":"53110f11-d98b-4b1f-824b-395fd9f373db","year":2017},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.346118Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:bd91416bb8b9265c96d9f4cdaded89d82dbf89282f0a54a604cab53e5b83ef0b","observation_id":"39be6769-fef2-4f87-b4b4-2efae404b9af","resolution":{"observed_at":"2026-08-16T04:42:47.907066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.353209Z","title":null,"venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.353209Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:d32521f109c50bce06283a47ca4f54fc4060ec28f6c46a1d641aea61f3631897","observation_id":"824da597-2d6a-497a-b566-38fab2cd8168","resolution":{"observed_at":"2026-08-16T04:42:46.353209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.364493Z","title":"Zero: Memory optimizations toward training trillion parameter models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.364493Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:6fddb935e8651a66193692946612feda8c89a4d899b6c092ae24dfb990a9fa6e","observation_id":"ff6275ec-546a-40c1-87f9-0107f1ce5b99","resolution":{"observed_at":"2026-08-16T04:42:46.364493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:47.837060Z","title":"M., and Levine, S","venue":null,"work_id":"03ef4c88-1c30-4fc5-950f-797a73eea096","year":2019},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.371022Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:2ce3b5c948f0c9c56213042a3cdcc821dc82123ad0e777fb5c28fd144eea3e2b","observation_id":"cb9e58ad-db17-4a90-890c-658dee56dd76","resolution":{"observed_at":"2026-08-16T04:42:47.849230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.380701Z","title":"Truncated back-propagation for bilevel optimization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.380701Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:54a67ca0033b6d448ad6d3dca8230117dc6e4d6838cc3fc7dae20deed2e131d4","observation_id":"f2523fd8-ac35-4916-a59f-8d5d535c1d6d","resolution":{"observed_at":"2026-08-16T04:42:46.380701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14095","last_updated":"2024-12-24T10:44:10Z","snapshot_observed_at":"2026-08-16T13:41:12.406448Z","submitted_at":"2024-06-20T08:21:52Z","title":"Memory-Efficient Gradient Unrolling for Large-Scale Bi-level Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14095","snapshot_observed_at":"2026-08-16T04:42:46.390626Z","title":"Memory-efficient gradient unrolling for large-scale bi-level optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.390626Z"},"links":{"cited_paper":"/paper/2406.14095","citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:053851db1a8316d6095a5ce55804213e268c90de66ae4b5effb8886f7b8cd247","observation_id":"22b6c6ef-7513-4898-972e-bf4a0ba752de","resolution":{"observed_at":"2026-08-16T04:42:46.390626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.403883Z","title":"Learning by directional gradient descent","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.403883Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:ff2a0cb75d51fd9407ba97dfb3690774f6824e2fc481c4f616356c88f8035b49","observation_id":"5feaf2da-89dd-4496-bc82-ca5c89a97f8c","resolution":{"observed_at":"2026-08-16T04:42:46.403883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.415996Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.415996Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:82aad25a50a45bc1849f3d78141789be7be036d279055cc187f7498b73357c79","observation_id":"e337355d-b8a0-4d61-bfa5-16f4139db296","resolution":{"observed_at":"2026-08-16T04:42:46.415996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:47.710848Z","title":null,"venue":null,"work_id":"b452999e-f3b6-4513-ad65-cd881c8274f1","year":1992},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.423646Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:3bba933176a0c6264d1a824d9c3b7c567204f48f227a849f1f4e9db135ed5030","observation_id":"157e5856-8317-4372-9628-e7976b80b7f2","resolution":{"observed_at":"2026-08-16T04:42:47.722439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.448028Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.448028Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:a1e0f224885b0141f5af294e2b0412a35274e4a73cb9dc7d688d4c2e5bedd13d","observation_id":"924bbdbd-0d5c-4f1a-a148-9277ebd2a3f1","resolution":{"observed_at":"2026-08-16T04:42:46.448028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:47.646589Z","title":null,"venue":null,"work_id":"6ee5ff47-59b5-454c-88d4-5aef8fa09116","year":1990},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.478959Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:3aed68ee032e51fbcc7cb54afb4fda1302f38da4678c5d4b5f1571465e1df2de","observation_id":"79f8510d-6389-4b98-b76f-c2db53c1c665","resolution":{"observed_at":"2026-08-16T04:42:47.668776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:47.587126Z","title":"W., Colmenarejo, S","venue":null,"work_id":"3e231a4d-dd4a-4e2f-a299-fb38feba6a20","year":2017},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.489583Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:389473de64f15f67969725c166d55c6b4491a7013cdf15232f8772d038fa88eb","observation_id":"4753ab15-5a44-4c82-8a6e-3e3ac5fc8015","resolution":{"observed_at":"2026-08-16T04:42:47.615915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:47.552180Z","title":"P., and Silver, D","venue":null,"work_id":"35c24a9f-5313-4ca5-b8f6-a006b99c4187","year":2018},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.496226Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:416aeda69aac66c493c9850a1faec53dfc21afeebcb4a71bd46595637cf6d8d7","observation_id":"1b4787f1-d63e-44d2-9e20-b22e691bfffa","resolution":{"observed_at":"2026-08-16T04:42:47.566420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:47.513396Z","title":"P., Silver, D., and Singh, S","venue":null,"work_id":"236eed09-8119-4fb3-9b61-4cc8e8e04c9a","year":2020},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.510825Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:5eaff9710975a6a93d3bf5e006ec585d631fb7566d1557b8456d20caa030865a","observation_id":"55edf4d0-57db-4133-b79a-d882ecdf433e","resolution":{"observed_at":"2026-08-16T04:42:47.529651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:42:46.521336Z","title":"An introduction to bilevel optimization: Foundations and applications in signal processing and machine learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T04:42:46.521336Z"},"links":{"citing_paper":"/paper/2505.00793"},"observation_digest":"sha256:cd181c758cebbb7ebbe76b364f02b41d59972058bd7039d4cce2c1c4c364b555","observation_id":"f40672e3-fc36-4be6-9da0-c4f001cb9948","resolution":{"observed_at":"2026-08-16T04:42:46.521336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.00793","last_updated":"2025-06-09T20:37:58Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T04:32:23.804068Z","submitted_at":"2025-05-01T18:46:44Z","title":"Scalable Meta-Learning via Mixed-Mode Differentiation"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2505.00793."}